Vláda USA nariadila Anthropic vypnúť najpokročilejšie modely Fable 5 a Mythos 5

Americká vláda donútila Anthropic okamžite stiahnuť z prevádzky jeho najpokročilejšie AI modely Fable 5 a Mythos 5 v rámci služby Claude.
Calude titulka
Zdroj: Lenka Ivančíková

Zásah prišiel cez núdzovú exportnú smernicu a prakticky odstavil prístup k týmto modelom celosvetovo. Podľa Anthropic sa príkaz opiera o národnú bezpečnosť a prišiel bez rozsiahlej úvodnej dokumentácie. Firma s rozhodnutím nesúhlasí a upozorňuje, že takto nastavený postup môže zmraziť vývoj naprieč technologickým sektorom.

Anthropic uvádza, že smernica dorazila 12. júna a nariaďuje zastaviť prístup k Fable 5 a Mythos 5 pre akéhokoľvek cudzieho štátneho príslušníka, bez ohľadu na to, či sa nachádza v USA alebo mimo nich. Týkať sa má aj zahraničných zamestnancov Anthropic.

Keďže ide o príkaz, pri ktorom je kľúčová bezchybná zhoda s podmienkami, Anthropic nakoniec vypol oba modely pre všetkých zákazníkov vrátane občanov USA. Zároveň zdôraznil, že prístup k ostatným modelom v jeho ponuke týmto rozhodnutím dotknutý nie je, čo vytvára nezvyčajný stav: služba funguje ďalej, no bez dvoch vlajkových modelov.

Dôvodom má byť „jailbreak“ zameraný na analýzu kódu

Jadrom sporu má byť odhalený „jailbreak“, teda postup, ktorým sa dá obísť časť bezpečnostných obmedzení modelu. Konkrétne má ísť o úzko zameraný a nie univerzálny trik, pri ktorom používateľ prinúti model prehľadať konkrétnu kódovú základňu s cieľom nájsť a opraviť softvérové zraniteľnosti.

To posúva celý problém z roviny bežnej bezpečnosti modelu do roviny exportných obmedzení. Ak sa AI dá použiť na identifikáciu a „patchovanie“ chýb v kóde, štát to môže vyhodnotiť ako riziko pre národnú bezpečnosť. Zároveň ide o precedens, kde sa reakcia netýka len konkrétnej funkcionality alebo nastavenia, ale vedie k úplnému komerčnému odstaveniu modelov.

Claude
Zdroj: Lenka Ivančíková

Úplná odolnosť nie je dnes reálna

Anthropic sa bráni tým, že pred uvedením modelov prebehli tisíce hodín red-teamingu v spolupráci s americkou vládou a britským UK AI Safety Institute. Firma zároveň tvrdí, že odhalené slabiny považuje za relatívne malé.

Zároveň dodáva, že podobné výsledky sa dajú dosiahnuť aj s inými verejne dostupnými „frontier“ modelmi, vrátane OpenAI GPT-5.5. Anthropic otvorene priznáva, že perfektná odolnosť voči jailbreakom je momentálne technicky nedosiahnuteľná, a preto stavia na prístup „defense in depth“ doplnený prísnym monitoringom, čo je aj jadro ich nesúhlasu s tým, že jeden úzko definovaný exploit má viesť k okamžitému globálnemu výpadku dvoch modelov.

Paralela s Huawei

Obmedzenie vyvoláva porovnania s krokom amerického ministerstva obchodu z roku 2019, keď sa Huawei dostal na Entity List a prišiel o prístup k americkým dodávateľským reťazcom a softvéru. V tomto prípade však nejde o zásah proti zahraničnej firme, ale o situáciu, keď USA obmedzujú prístup k vlastnému domácemu softvéru kvôli geopolitickým a bezpečnostným obavám.

Nemali by ste prehliadnuť:

Ak by sa podobná prax začala uplatňovať plošne, každá novo odhalená zraniteľnosť alebo bezpečnostný obchvat by mohol znamenať náhle odstavenie komerčne používaného modelu. Anthropic uvádza, že s úradmi aktívne pracuje na vyriešení situácie a obnovení prístupu, no samotný mechanizmus zásahu už teraz mení to, ako firmy aj zákazníci môžu vnímať dostupnosť špičkových AI modelov ako služieb.

Total
0
Shares
Podobné články