Zásah prišiel cez núdzovú exportnú smernicu a prakticky odstavil prístup k týmto modelom celosvetovo. Podľa Anthropic sa príkaz opiera o národnú bezpečnosť a prišiel bez rozsiahlej úvodnej dokumentácie. Firma s rozhodnutím nesúhlasí a upozorňuje, že takto nastavený postup môže zmraziť vývoj naprieč technologickým sektorom.
Anthropic uvádza, že smernica dorazila 12. júna a nariaďuje zastaviť prístup k Fable 5 a Mythos 5 pre akéhokoľvek cudzieho štátneho príslušníka, bez ohľadu na to, či sa nachádza v USA alebo mimo nich. Týkať sa má aj zahraničných zamestnancov Anthropic.
Keďže ide o príkaz, pri ktorom je kľúčová bezchybná zhoda s podmienkami, Anthropic nakoniec vypol oba modely pre všetkých zákazníkov vrátane občanov USA. Zároveň zdôraznil, že prístup k ostatným modelom v jeho ponuke týmto rozhodnutím dotknutý nie je, čo vytvára nezvyčajný stav: služba funguje ďalej, no bez dvoch vlajkových modelov.
Dôvodom má byť „jailbreak“ zameraný na analýzu kódu
Jadrom sporu má byť odhalený „jailbreak“, teda postup, ktorým sa dá obísť časť bezpečnostných obmedzení modelu. Konkrétne má ísť o úzko zameraný a nie univerzálny trik, pri ktorom používateľ prinúti model prehľadať konkrétnu kódovú základňu s cieľom nájsť a opraviť softvérové zraniteľnosti.
To posúva celý problém z roviny bežnej bezpečnosti modelu do roviny exportných obmedzení. Ak sa AI dá použiť na identifikáciu a „patchovanie“ chýb v kóde, štát to môže vyhodnotiť ako riziko pre národnú bezpečnosť. Zároveň ide o precedens, kde sa reakcia netýka len konkrétnej funkcionality alebo nastavenia, ale vedie k úplnému komerčnému odstaveniu modelov.

Úplná odolnosť nie je dnes reálna
Anthropic sa bráni tým, že pred uvedením modelov prebehli tisíce hodín red-teamingu v spolupráci s americkou vládou a britským UK AI Safety Institute. Firma zároveň tvrdí, že odhalené slabiny považuje za relatívne malé.
Zároveň dodáva, že podobné výsledky sa dajú dosiahnuť aj s inými verejne dostupnými „frontier“ modelmi, vrátane OpenAI GPT-5.5. Anthropic otvorene priznáva, že perfektná odolnosť voči jailbreakom je momentálne technicky nedosiahnuteľná, a preto stavia na prístup „defense in depth“ doplnený prísnym monitoringom, čo je aj jadro ich nesúhlasu s tým, že jeden úzko definovaný exploit má viesť k okamžitému globálnemu výpadku dvoch modelov.
Paralela s Huawei
Obmedzenie vyvoláva porovnania s krokom amerického ministerstva obchodu z roku 2019, keď sa Huawei dostal na Entity List a prišiel o prístup k americkým dodávateľským reťazcom a softvéru. V tomto prípade však nejde o zásah proti zahraničnej firme, ale o situáciu, keď USA obmedzujú prístup k vlastnému domácemu softvéru kvôli geopolitickým a bezpečnostným obavám.

Nemali by ste prehliadnuť:
- Google predstavil DiffusionGemma: AI model generuje text až 4× rýchlejšie
- Keď chýba mentálna energia, pomôžu zelené miesta, spánok a jedlo
- Kruhová ekonomika môže znížiť emisie v doprave

Ak by sa podobná prax začala uplatňovať plošne, každá novo odhalená zraniteľnosť alebo bezpečnostný obchvat by mohol znamenať náhle odstavenie komerčne používaného modelu. Anthropic uvádza, že s úradmi aktívne pracuje na vyriešení situácie a obnovení prístupu, no samotný mechanizmus zásahu už teraz mení to, ako firmy aj zákazníci môžu vnímať dostupnosť špičkových AI modelov ako služieb.