Americká vláda nariadila spoločnosti Anthropic, aby okamžite obmedzila prístup k svojim najpokročilejším modelom Fable 5 a Mythos 5 v službe Claude. Rozhodnutie prišlo formou núdzovej exportnej smernice a v praxi znamenalo, že tieto modely prestali byť dostupné používateľom po celom svete.
Podľa Anthropic sa príkaz odvoláva na národnú bezpečnosť. Firma však tvrdí, že prišiel bez podrobnejšej úvodnej dokumentácie a s rozhodnutím nesúhlasí. Upozorňuje, že podobný postup môže spomaliť vývoj nielen v oblasti umelej inteligencie, ale aj v širšom technologickom sektore.
Obmedzenie sa dotklo aj používateľov v USA
Anthropic uvádza, že smernicu dostal 12. júna. Príkaz mal zastaviť prístup k modelom Fable 5 a Mythos 5 pre každého cudzieho štátneho príslušníka, bez ohľadu na to, či sa nachádza v USA alebo v zahraničí. Týkať sa mal aj zahraničných zamestnancov samotnej firmy.
Keďže pri takomto type nariadenia nesmie dôjsť k porušeniu podmienok, Anthropic sa rozhodol pre najprísnejší postup. Oba modely vypol pre všetkých zákazníkov, vrátane občanov USA.
Služba Claude ako taká funguje ďalej. Používatelia majú stále prístup k ostatným modelom v ponuke, no dva najvýkonnejšie modely sú dočasne mimo prevádzky.
Problémom má byť jailbreak pri práci s kódom
Dôvodom zásahu má byť odhalený jailbreak. Ide o spôsob, ako obísť časť bezpečnostných obmedzení AI modelu. V tomto prípade nemalo ísť o všeobecné prelomenie ochrany, ale o úzko zameraný postup pri analýze zdrojového kódu.
Používateľ mal vedieť model naviesť tak, aby prehľadal konkrétnu kódovú základňu a hľadal v nej softvérové zraniteľnosti. Práve táto schopnosť mohla byť podľa amerických úradov vyhodnotená ako riziko pre národnú bezpečnosť.
Zásah je preto nezvyčajný. Namiesto úpravy jednej funkcie alebo bezpečnostného nastavenia viedol k úplnému odstaveniu dvoch komerčne dostupných modelov.
Anthropic tvrdí, že úplná ochrana dnes nie je možná
Anthropic sa bráni tým, že pred uvedením modelov prebehli tisíce hodín testovania. Na red-teamingu spolupracoval aj s americkou vládou a britským UK AI Safety Institute. Firma zároveň tvrdí, že zistené slabiny považuje za relatívne malé.
Dodáva, že podobné výsledky sa dajú dosiahnuť aj s inými verejne dostupnými pokročilými AI modelmi. Podľa Anthropic dnes neexistuje spôsob, ako zabezpečiť úplnú odolnosť voči jailbreakom. Preto firma používa viacero vrstiev ochrany a priebežný monitoring.
Pre AI firmy môže ísť o dôležitý precedens
Celá situácia pripomína zásah USA voči spoločnosti Huawei z roku 2019, keď sa čínska firma dostala na Entity List a prišla o prístup k časti amerických technológií. Tentoraz je však situácia iná. USA neobmedzujú zahraničnú firmu, ale vlastný domáci softvér.

Nemali by ste prehliadnuť:
- Waze dobieha konkurenciu. Nová funkcia vodičom uľahčí orientáciu na cestách
- YouTube chce konkurovať Messengeru. Do aplikácie pridáva súkromné správy
- Instagram prináša užitočnú novinku. Používatelia si môžu usporiadať profil podľa vlastných predstáv

Ak by sa podobný postup začal používať častejšie, každá nová zraniteľnosť alebo bezpečnostný obchvat by mohol viesť k náhlemu vypnutiu komerčne používaného AI modelu.
Anthropic uvádza, že s úradmi pracuje na vyriešení situácie a obnovení prístupu k modelom. Už teraz je však jasné, že tento prípad môže zmeniť pohľad firiem aj zákazníkov na spoľahlivosť a dostupnosť najpokročilejších AI služieb.
