Blog Governance Za hranice inovací
Když regulace vypne AI: lekce z 18denního patu kolem Fable 5
Cizí vláda přes noc znepřístupnila frontier model. Skončilo to za 18 dní. Píšu, co si z toho má odnést každý, kdo staví provoz na cizí AI.
Jaroslav Urbánek, zakladatel TECHNOMATONu 2. července 2026 5 min čtení
Před třemi týdny jsem tady rozebíral Claude Fable 5 a Mythos 5. O dva dny později je vypnula cizí vláda. Ne poruchou, ne kybernetickým útokem. Jedním regulatorním příkazem, bez varování a bez možnosti se odvolat.
Dnes je po všem. Americké Ministerstvo obchodu zrušilo vývozní kontroly a Anthropic od 1. července obnovuje globální přístup k Fable 5. Stojí ale za to rozebrat, co se dělo mezitím. Ne kvůli výpadku, ten byl v praxi minimální. Modely byly venku sotva tři dny a nikdo je nestihl produkčně nasadit. Píšu o tom proto, že se poprvé naostro předvedl mechanismus, se kterým musí do budoucna počítat každý, kdo staví architekturu na cizích modelech.
Časová osa
- 9. června Anthropic vydal dvojici Fable 5 a Mythos 5. Stejné jádro, jiná míra ochran. Fable 5 dostal silné pojistky pro veřejné použití, Mythos 5 s menším počtem ochran jen úzká skupina prověřených partnerů pro defenzivní kyberbezpečnost.
- 12. června přišla direktiva Ministerstva obchodu s odkazem na národní bezpečnost. Spouštěčem byla zpráva výzkumníků Amazonu. Našli způsob, jak obejít ochrany Fable 5 a přimět model najít softwarové zranitelnosti. V jednom případě dokonce vygeneroval ukázkový kód, který zneužití demonstroval.
- Direktiva chtěla zamezit přístup všem cizím státním příslušníkům, uvnitř i mimo USA, včetně vlastních zaměstnanců Anthropicu bez amerického občanství. Národnost uživatelů nešlo v reálném čase spolehlivě ověřit, a tak Anthropic stáhl oba modely úplně pro všechny. Během pár hodin zhasly Bedrock, Google Cloud, Microsoft Foundry i přímé API.
- 30. června byly kontroly zrušeny. 1. července se Fable 5 vrací globálně.
Celý pat trval 18 dní. Modely přitom byly veřejně dostupné sotva tři.
Detail, který v titulcích zapadl
Tohle je moment, který rozhoduje o tom, jak celou kauzu číst. Anthropic po dvou týdnech testování doložil, že popsanou zranitelnost najdou i výrazně slabší modely. Včetně Claude Opus 4.8, GPT-5.5 nebo Kimi K2.7. A samotnou demonstraci zneužití zvládl v podstatě každý testovaný model.
Jinými slovy: hlášená technika neodhalila žádnou schopnost, kterou by měl jen Fable 5. Šlo o hraniční nastavení ochran, ne o únik nebezpečné superschopnosti. Anthropic přesto zareagoval a natrénoval nový klasifikátor, který tuhle konkrétní techniku blokuje ve více než 99 % případů.
Rozdíl mezi oběma modely je přitom skutečný. Mythos 5 umí hledat a zneužívat zranitelnosti účinněji než jakýkoli jiný model a než všichni kromě špičkových lidských expertů. Právě proto ji dostala jen hrstka partnerů. Fable 5 takovou unikátní ofenzivní schopnost nemá. Vyšel s nejsilnějšími ochranami, jaké kdy Anthropic nasadil.
Vrací se, ale jinak
Fable 5 se nevrací beze změny. Z vyjádření Anthropicu plynou čtyři věci.
Přísnější filtry. Model má tvrdší kontrolu na rizikové kyberbezpečnostní úlohy. Když je požadavek zablokován, uživatel dostane upozornění a dotaz se přesměruje na Opus 4.8. Cenou je vyšší míra falešných poplachů. Část běžného kódování a ladění bude zpočátku padat zpět na Opus 4.8. Anthropic slibuje filtry postupně ladit, aby lépe oddělily skutečné zneužití od legitimní práce.
Návrat po plánech. Pro Pro, Max, Team a vybrané Enterprise plány je Fable 5 do 7. července zahrnut až do 50 % týdenního limitu, potom přes kreditové čerpání. Přístup na AWS, Google Cloud a Microsoft Foundry se obnovuje co nejrychleji.
Společný oborový rámec pro jailbreaky. Pro mě nejzajímavější výstup celé kauzy. Obor dosud nemá shodu, jak objektivně měřit závažnost obejití ochran. Anthropic proto s Amazonem, Microsoftem a Googlem začal psát společný standard. Jailbreak navrhuje hodnotit podle čtyř kritérií: o kolik posune útočníka za běžně dostupné nástroje, pro kolik různých úloh funguje, kolik lidského úsilí stojí proměnit ho v reálný útok a jak snadno se dá získat.
Hlubší spolupráce se státem. Anthropic rozšiřuje spolupráci s americkou vládou. Předběžný přístup k modelům pro evaluaci, sdílení informací o zneužití a jailbreacích, vyhrazené zdroje pro společný výzkum. Navazuje to na červnové prezidentské nařízení o inovacích a bezpečnosti pokročilé AI.
Kde je skutečná lekce
Politický rozměr nechám jiným. A rovnou odmítnu i dramatické líčení, které se objevilo v části médií. Že firmy „přišly o svou inteligenční vrstvu” a zachránil je připravený fallback. U těchhle modelů to není pravda. Fable 5 a Mythos 5 byly venku tři dny, nikdo si na nich nepostavil produkci. Reálný provozní dopad byl minimální.
Cenné je něco jiného. Poprvé se naostro předvedl mechanismus. Regulatorní kill-switch nebyl řádek v rizikové matici, ukázal se jako funkční, okamžitý, globální a bez odvolání. A příště nemusí dopadnout na třídenní novinku, ale na model, který skutečně pohání váš provoz.
Minule jsem psal o hranicích, které kolem sebe kreslí model sám: co odmítne, co pošle na fallback. Tahle hranice je jiná. Nekreslí ji model, kreslí ji stát. A do rizikové analýzy AI závislostí tím přibyla nová položka. Vedle výpadku datacentra a změny ceníku poskytovatele teď stojí i státní zásah do dostupnosti konkrétního modelu.
Přesně tohle s klienty procházím pod hlavičkou technologické suverenity. Otázka nezní „jaký model používáte”, ale „víte, kde končí vaše kontrola a začíná cizí”. Tři body, které po téhle kauze dostávají jinou váhu:
- Koncentrace na jednoho poskytovatele. Pokud kritický proces stojí na jednom modelu jednoho vendora, máte tam jednobodové selhání, které neřeší žádná SLA. Regulatorní zásah je teď precedens, ne poznámka pod čarou. Stát dokáže znepřístupnit frontier model přes noc, celosvětově, a vy s tím nehnete.
- Otestovaný exit. Záložní model na papíře nestačí. Odzkoušený hot-swap, třeba na Opus 4.8, je rozdíl mezi hodinovým přepnutím a týdenním výpadkem. A záloha má smysl jen tehdy, když umíte změřit, že se chová srovnatelně. Jinak jste jen vyměnili jeden problém za druhý.
- Návrat neznamená návrat do stejného stavu. Fable 5 se vrací s přísnějšími filtry a vyšší mírou falešných poplachů. Kdo staví agentní pipeline na konkrétním chování modelu, musí počítat s tím, že se to chování po regulatorním zásahu posune. A musí to zachytit v testech dřív než v produkci.
Model se dá vyměnit. Nezmapovaná závislost ne.
Zdroje: oficiální blog Anthropicu „Redeploying Fable 5” (30. 6. 2026) a prohlášení Ministerstva obchodu USA. Stav k 1. 7. 2026.