Hlavní obsah

Nejpokročilejší modely Claude mají stopku. Americká vláda se bojí zneužití

Foto: gguy, Shutterstock.com

Ilustrační snímek.

aktualizováno •

Společnost Anthropic musela na pokyn americké vlády zablokovat přístup k nejpokročilejším modelům AI všem cizincům. Nové modely tak aktuálně nemůže používat vůbec nikdo. Direktivu Washington zdůvodnil obavami o národní bezpečnost.

Článek

Vláda Spojených států nařídila firmě Anthropic pozastavit cizincům přístup k jejím nejpokročilejším modelům umělé inteligence. Zdůvodnila to obavami o národní bezpečnost. S odkazem na páteční oznámení firmy o tom informuje agentura Reuters.

Vládní směrnice se týká nejvýkonnějších modelů Fable 5 a Mythos 5. Kalifornská laboratoř Anthropic nové modely uvedla na trh ke komerčnímu využití teprve před třemi dny. Model Mythos firma Anthropic představila už v dubnu, ale kvůli obavám ze zneužití pro kyberútoky jej zpřístupnila jen hrstce vybraných dodavatelů software.

Přístup teď nemá nikdo, ani Američané

V pátek v 17:21 washingtonského času (23:21 středoevropského času) dorazil do firmy Anthropic oficiální dopis, který napsal americký ministr průmyslu a obchodu Howard Lutnick přímo šéfovi firmy Anthropic. Dopis uvádí, že Anthropic má zákaz poskytovat nové modely cizincům nebo cizím firmám.

„Americká vláda nám nařídila (…) zastavit veškerý přístup k modelům Mythos 5 a Fable 5 jakýmkoli cizincům, ať už jsou v USA, nebo kdekoli jinde, a to včetně cizinců, kteří pracují pro naši firmu,“ píše Anthropic v prohlášení.

„V důsledku tohoto nařízení musíme u všech našich zákazníků okamžitě deaktivovat modely Fable 5 a Mythos 5, abychom zajistili dodržování předpisů. Přístup ke všem ostatním modelům společnosti Anthropic tím nebude ovlivněn,“ uvedla firma. Na vysvětlenou dodala, že není schopna třídit uživatele podle jejich státní příslušnosti.

Foto: Pavel Kasík, Seznam Zprávy

Zákazníci našli v chatbotu Claude upozornění o nedostupnosti modelů Fable.

Firma uvedla, že pracuje na nápravě: „Omlouváme se našim zákazníkům za toto přerušení a pracujeme na co nejrychlejším obnovení přístupu.“

Mocný Mythos a osekaný Fable

S tím, že je nový model Mythos (a jeho omezená verze Fable) velmi mocný a potenciálně nebezpečný, souhlasí v principu i firma Anthropic. Ta ostatně právě proto v dubnu předchozí verzi tohoto modelu (Mythos Preview) odmítla zpřístupnit veřejnosti. Důvodem byly schopnosti modelu „najít zranitelnosti v software a tyto zranitelnosti zřetězit k účinnému převzetí kontroly“. Takováto schopnost by mohla kyberútočníkům otevřít bezprecedentní možnosti útoků.

Původní model Mythos firma nepustila ven

Místo toho tehdy Anthropic dal přístup jen vybraným firmám (například Cisco, Microsoft, Google, CrowdStrike nebo organizacím udržujícím open-sourcové projekty), aby pomocí tohoto modelu mohly najít bezpečnostní díry a případně je zazáplatovat. Například organizace Mozilla pomocí Mythosu v dubnu zazáplatovala 271 bezpečnostních děr, o řád více, než bylo do té doby obvyklé.

Vysoké schopnosti modelu Mythos potvrzují i nezávislé testy:

Nová verze Mythos 5 je podle Anthropicu dokonce ještě šikovnější: „Claude Mythos 5 má nejsilnější celkové kybernetické schopnosti ze všech modelů, které jsme kdy hodnotili. Právě skokové zlepšení Preview v samostatném hledání a zneužívání softwarových zranitelností nás vedlo k tomu, abychom přístup omezili na úzkou skupinu partnerů pro účely obranné kybernetické bezpečnosti.“

Pro ostatní pak Anthropic v úterý 9. června uvedl „osekanou“ variantu modelu Mythos, pod názvem Fable 5: „Claude Fable 5 je nasazen s několika novými pojistkami, které nám umožňují bezpečně ho vydat pro běžné použití. Tyto nové pojistky jsou klasifikátory, které se aktivují, když rozpoznají témata spojená s kybernetickou bezpečností, biologií a chemií nebo s pokusy o destilaci (trénování konkurenčního modelu, pozn. red.).“

Co konkrétně americké vládě vadí?

Model Fable by tedy neměl umožnit zneužití k pokročilým útokům, ať už kybernetickým, nebo biochemickým. To potvrzovaly i prvotní zkušenosti uživatelů: model Fable v řadě případů odmítal řešit úlohy, které se byť jen vzdáleně dotýkaly potenciálně citlivých témat.

Takové „citlivé“ dotazy přesměrovával na starší modely od stejné firmy. Co konkrétně tedy americká administrativa firmě Anthropic vytýká?

Podle zjištění redakce Axios americké ministerstvo průmyslu a obchodu reagovalo na zjištění blíže neuvedené firmy, která zjistila, že zabezpečení modelu Mythos lze obejít. Americká vláda údajně už předtím žádala firmu Anthropic, aby uvedení nových modelů odložila.

Anthropic se domnívá, že došlo k nedorozumění. Podle nich šlo o banální příklad tzv. jailbreaku (obejití bezpečnostních opatření u AI chatbota, pozn. red.), který nepředstavuje žádné reálné nebezpečí nad rámec toho, co umožňuje jakýkoli konkurenční model: „Prohlédli jsme si ukázku této techniky na obcházení bezpečnostních opatření, pomocí které šlo odhalit některé relativně jednoduché zranitelnosti,“ uvedla firma ve svém prohlášení. „Zpráva, na základě které zřejmě americká vláda vydala své nařízení, neukazuje nic, co by nezvládly konkurenční modely, včetně GPT-5.5 od OpenAI.“

Regulace ano, ale transparentně, žádá firma

Společnost Anthropic založili v roce 2021 bývalí zaměstnanci firmy OpenAI. Zakladatelé, sourozenci Dario Amodei a Daniela Amodei, odešli právě proto, aby se mohli soustředit na vývoj bezpečné umělé inteligence. Od té doby OpenAI představila svůj populární chatbot ChatGPT, který odstartoval masový zájem o nástroje generativní AI. Vlajkovým produktem firmy Anthropic je chatbot Claude, který byl uveden na trh v roce 2023. Vysokou popularitu si získal jejich nástroj Claude Code, určený k programování.

Firma Anthropic se dlouhodobě prezentuje jako zastánce bezpečného a zodpovědného vývoje umělé inteligence a superinteligence. „Vždy jsem byl zastáncem zodpovědné a promyšlené regulace těchto technologií,“ řekl například šéf společnosti, Dario Amodei, v pořadu CBS News v listopadu 2025. „Obávám se věcí, které si ani neumíme představit. A proto se snažíme předvídat, co se dá. Přemýšlíme o ekonomických dopadech AI, přemýšlíme o tom, jak lze tyto modely zneužít nebo zda se mohou vymknout kontrole.“

Anthropic tedy uznává, že by vláda měla mít možnost AI laboratoře kontrolovat a regulovat: „Domníváme se, že vláda by měla mít možnost zablokovat nebezpečná nasazení AI nástrojů, a to v rámci zákonného postupu, který je transparentní, spravedlivý, srozumitelný a opřený o technická fakta.“ Aktuální vládní zákaz se ale podle nich těmito zásadami vůbec neřídí.

„Nesouhlasíme s tím, že by nález úzce zaměřeného potenciálního jailbreaku měl být důvodem ke stažení komerčního modelu, který používají stovky milionů lidí,“ ohradila se firma Anthropic proti zákazu. „Pokud by se toto měřítko uplatnilo na celé odvětví, podle nás by to v podstatě zastavilo nasazování všech nových modelů u všech předních vývojářů.“

Přetahovaná o umělou inteligenci pokračuje

Vztahy mezi administrativou Donalda Trumpa a firmou Anthropic jsou už tak napjaté. Připomeňme si v této souvislosti březnový spor firmy Anthropic s americkou vládou o zapojení jejích modelů v armádě, kdy to byla naopak laboratoř Anthropic, která se obávala zneužití modelu a odmítala odstranit ze smlouvy pojistky ohledně nasazení autonomní AI v bitvě nebo k masovému šmírování.

„Levičáčtí cvoci z Anthropicu udělali KATASTROFÁLNÍ CHYBU, když se pokusili VYDÍRAT ministerstvo války,“ napsal tehdy na své síti Truth Social prezident Donald Trump.

Americké ministerstvo pak následně označilo firmu Anthropic za „riziko pro dodavatelský řetězec“, což znamená, že některé vládní agentury a externí dodavatelé musejí co nejdříve (v řádu měsíců) přestat produkty Anthropic používat.

Společnost Anthropic navíc počátkem června předložila plán pro vstup na burzu cenných papírů. I to se může promítnout do jejího sporu s vládou USA. Zákaz exportu jejích nejpokročilejších modelů by totiž logicky ovlivnil, jak aktuální i budoucí investoři vnímají budoucnost firmy.

V současné chvíli je na stole více možností řešení situace. Firma Anthropic doufá, že se jí podaří přesvědčit ministerstvo o tom, že to, co považuje za nebezpečnou ukázku zneužití, je něco, co zvládají i konkurenční modely: „Vláda nám dosud poskytla pouze ústní důkaz o možném úzce zaměřeném, neuniverzálním obejití zabezpečení, které v podstatě spočívá v tom, že model dostane za úkol přečíst konkrétní zdrojový kód a opravit v něm softwarové chyby,“ uvádí Anthropic.

Může jít o první signál toho, že neregulované uvolňování nových modelů, kterého jsme byli svědky od roku 2022, může skončit. To by ostatně odpovídalo tomu, po čem – alespoň ve svých veřejných prohlášeních – volají i zakladatelé všech předních AI laboratoří. Aktuální zákaz ale působí jako ad hoc řešení. Těžko tedy odhadovat, zda je první známkou promyšlenější regulace, nebo naopak bezradnosti.

Doporučované