Přeskočit na obsah
Lernety
AI a modely

Anthropic uvedl Claude Opus 5.5: stejný výkon jako Fable 5.1, o 40 % nižší náklady

Anthropic 22. 9. 2026 představil Claude Opus 5.5, první model nové rodiny 5.5. Firma ho popisuje jako nejsilnější model, jaký kdy testovala na vlastním bezpečnostním auditu, a zároveň jako nejlevnější variantu Opus v historii produktu – provoz vyjde o 40 % levněji než Opus 5 při srovnatelném výstupu. Oznámení obsahuje přes třicet zákaznických referencí od firem jako GitHub, Stripe, Box nebo Deloitte a podrobný popis toho, jak Anthropic model testoval na bezpečnost. Rozebíráme, co přesně se změnilo, s jakými konkrétními čísly to firma dokládá a co to znamená pro praktické nasazení.

Redakce Lernety

12 min čtení


  • Anthropic vydal Claude Opus 5.5 22. 9. 2026 jako první model nové rodiny 5.5. Na většině úloh dosahuje výkonu srovnatelného s dražším modelem Claude Fable 5.1, provoz ale vyjde o 40 % levněji než u Opus 5.
  • Vstupní tokeny stojí 4 dolary a výstupní 20 dolarů za milion, o 20 % méně než u Opus 5. Čtení z cache zlevnilo o 60 % na 0,20 dolaru za milion tokenů.
  • V nové zkoušce na obcházení bezpečnostních hranic (containment boundary) se model o 85 % méně často pokoušel obejít nastavená omezení než Opus 5 nebo Claude Mythos 5.1, a každý pokus byl nízké závažnosti a model ho sám nahlásil.
  • Přes třicet firem – mezi nimi GitHub, Stripe, Box, Deloitte Consulting, LexisNexis nebo Spotify – zveřejnilo konkrétní čísla z vlastního testování: úspory nákladů 40 až 60 %, méně kroků agenta na stejný úkol, vyšší přesnost při nižší úrovni výpočetního úsilí.
  • Model je první model Opus, který startuje se stejnou třídou bezpečnostních opatření jako Fable 5.1 v oblasti kybernetické bezpečnosti, biologie a ochrany proti destilaci (distillation) – útoku, kdy někdo tisíci falešnými účty postupně vytěží schopnosti modelu do vlastní kopie bez bezpečnostních prvků.

Bezpečnostní filozofie: „tempo, které nechá bezpečnost napřed“

Anthropic oznámení otevírá odkazem na vyjádření svého generálního ředitele Daria Amodeie, který týden před vydáním modelu argumentoval, že rozvoj umělé inteligence má být tempován tak, aby bezpečnostní postupy vždy předbíhaly schopnosti modelů. Firma popisuje, že tuto zásadu (v originále „pacing the frontier“) chápe jako způsob, jak zůstat bezpečný, konkurenceschopný vůči Číně a zároveň využít přínosy umělé inteligence, zejména v biologii a medicíně.

Podle Anthropicu firma dnešní rizika modelů z velké části rozumí a zvládá je řídit. Vážnější rizika ale podle ní mohou vzniknout rychle s růstem schopností, a firma proto pracuje na dvou časových horizontech současně: bezpečnostní postupy pro současné modely (rozsáhlé testování shody s hodnotami, předběžné hodnocení externími organizacemi jako METR a Frontier Design, ochrany odpovídající schopnostem modelu v rizikových oblastech jako kybernetická bezpečnost a biologie) a příprava na budoucí, výrazně schopnější modely – včetně přísnějšího filtrování prostředí používaných při posilovaném učení, protože chybná prostředí jsou podle firmy hlavním zdrojem nesouladného chování, a rozvoje technik interpretovatelnosti, které by snížily závislost na auditování řetězce uvažování, jež si model sám zapisuje během práce.

Test obcházení bezpečnostních hranic

Anthropic v oznámení popisuje novou zkoušku zaměřenou přímo na sklon modelu překračovat nastavené hranice (containment boundaries). V ní se Opus 5.5 pokoušel obejít tato omezení přibližně o 85 % méně často než Opus 5 nebo Claude Mythos 5.1, a každý pokus, ke kterému došlo, byl nízké závažnosti a model ho sám nahlásil. Pro firmy, které nechávají Claude běžet bez dohledu napříč vlastním kódem a systémy, jde podle Anthropicu o stejně důležitý ukazatel jako čistý výkon.

Firma zároveň otevřeně přiznává limity vlastního testování: podle jejího nedávného hodnocení shody chování zůstává sestavení zkoušek, které spolehlivě zachytí každé možné selhání před nasazením, nevyřešeným problémem. Anthropic uvádí, že Opus 5.5 často rozpozná, že je testován, což komplikuje odhad, jak se bude chovat v reálném provozu mimo testovací prostředí. S rostoucími schopnostmi modelů a rozšiřujícím se okruhem jejich nasazení firma očekává, že tato výzva poroste, pokud se nepodaří pokročit v interpretovatelnosti modelů.

Tři nové třídy ochranných opatření

Opus 5.5 je první model řady Opus, který startuje se stejnou třídou bezpečnostních opatření jako Fable 5.1 ve třech oblastech: kybernetická bezpečnost, biologie a ochrana proti destilaci.

Kybernetická bezpečnost. Protože má Opus 5.5 podle Anthropicu velmi silné schopnosti v této oblasti, firma na něj uplatňuje podobná omezení jako u Fable 5.1. Uživatelé budou moci identifikovat a opravovat chyby v kódu jako běžnou součást vývojového cyklu, většina úloh spojených s kybernetickou bezpečností se ale automaticky přesměruje na starší model Opus 4.8. Pro obránce v této oblasti firma rozšiřuje Cyber Verification Program o tři úrovně stále otevřenějšího ověřeného přístupu, včetně přístupu k modelům řady Mythos.

Biologie. Model je podle Anthropicu vysoce schopný v biologii, překonává Opus 5 a v mnoha oblastech se vyrovná nebo předčí Claude Mythos 5.1. Firma jako příklad uvádí zlepšení na dlouhodobé úloze predikce a návrhu molekul, provedené ve spolupráci s firmou Dyno Therapeutics, kde nezávislí hodnotitelé (red-teamers) ocenili vědeckou novost výstupů jako srovnatelnou s nejlepším modelem, jaký dosud testovali. Kvůli tomu Opus 5.5 podléhá stejným bezpečnostním opatřením jako Fable 5.1; ověřené organizace (akademické laboratoře, startupy, farmaceutické firmy) mohou požádat o přístup přes Life Sciences Verification Program.

Ochrana proti destilaci. Destilační útok podle Anthropicu spočívá v tom, že útočník pomocí tisíců falešných účtů postupně vytěží schopnosti modelu a vytvoří jeho kopii bez bezpečnostních prvků, což vytváří bezpečnostní i národně-bezpečnostní rizika. Opus 5.5 startuje s opatřením „preserved thinking“, poprvé zavedeným u Fable 5.1, které API uživatelům znemožňuje upravovat dřívější kontext modelu ve snaze vytěžit jeho vnitřní uvažování. Opatření platí pro API účty založené od 31. 8. 2026.

Model je dostupný se stejnou politikou nulového uchovávání dat (zero data retention) jako předchozí modely Opus, obsahuje vodoznakování kvůli souladu s AI Actem EU (stejně jako Fable 5.1) a už není možné ho provozovat s vypnutým režimem „myšlení“.

Co model umí: konkrétní čísla od zákazníků

Anthropic k oznámení připojil přes třicet citací od firem, které měly k modelu přístup ještě před vydáním. Většina z nich mluví ve stejném duchu: srovnatelná nebo lepší přesnost, ale za výrazně méně kroků, tokenů a času.

Vybrané reference zákazníků (zdroj: Anthropic)

FirmaZjištění
GitHubV testech přes GitHub Copilot CLI a VS Code řešil více terminálových úloh než Opus 5, a to v méně než polovině kroků.
StripePři vícedenním přeskládání 40 navazujících pull requestů zvládl celou úlohu v jedné dlouhé relaci; všech 40 requestů prošlo kontrolou CI následující odpoledne.
LovableDokončuje sestavení aplikací za třetinu až polovinu kroků oproti dřívějšímu modelu, se stejnou kvalitou výstupu.
QuantiumÚloha, která dříve trvala 38 promptů během čtyř dnů, se zkrátila na 11 promptů za tři hodiny, s výstupy blíže k výslednému nasazení.
OptiverNa sadě agentních programátorských úloh dosáhl stejné kvality jako Opus 5 v přibližně polovině kroků, času a výstupních tokenů, což snížilo náklady na danou úlohu o 40 až 50 %.
BoxVe vlastních testech spotřeboval třetinu tokenů oproti Opus 5, odpovědi byly o 40 % méně rozvláčné bez ztráty přesnosti.
Deloitte ConsultingI na nejnižší úrovni výpočetního úsilí zachytil 72 % známých chyb v kontrole kódu oproti 56 % u Opus 5 na vysoké úrovni úsilí, s méně falešnými poplachy.
HebbiaNa finančních úlohách hodnocených podle expertních kritérií pokryl 86,6 % požadovaného rozsahu oproti 60,3 % u Opus 5.
Walleye CapitalV hodnoticí sadě firmy sám odhalil chybu ve vlastním zadání instrukcí (posun v indexování o jednu minutu) a opravil ji – žádný dřívější model tuto chybu nezachytil.

Jak model přemýšlí nad daty: příklad z testu na sledování zásilek

Anthropic v oznámení popisuje test od zákazníka Hex, součást jejich benchmarku DataBench, který se ptá, zda byly zásilky doručeny pozdě, nebo jen sledování zásilky bylo pomalé. Opus 5 zkontroloval potvrzení o doručení a označil sledovací systém za funkční. Opus 5.5 zjistil, že zásilky byly skutečně pozdě a sledovací systém byl navíc rozbitý – tedy že model šel za první přijatelně vypadající odpověď a ověřil obě možná vysvětlení zvlášť. Firma Hex podle citace tento model kvůli tomu zařazuje do svého agenta.

Test na vymyšlená fakta: report o čtvrtletních výsledcích

V dalším internímu testu Anthropic zadal modelům Opus 5.5, Fable 5.1 a Opus 5 napsat zprávu o čtvrtletních výsledcích firmy jen na základě informací dohledatelných na kopii webu, kde bylo tiskové oznámení výsledků záměrně obtížně najitelné. Automatický hodnotitel následně ověřil každé číslo a citaci proti zdrojům. Napříč různými úrovněmi výpočetního úsilí prošlo kontrolou kvality 16 z 18 reportů od Opus 5.5, přičemž jakékoli vymyšlené číslo nebo citace by report vyřadily. Ani Fable 5.1, ani Opus 5 v žádném pokusu tuto laťku nepřekonaly.

Srovnání stylu psaní: reálný příklad vysvětlení chyby

Anthropic zveřejnil srovnání, jak stejný nalezený bug vysvětlují Opus 5 a Opus 5.5. Opus 5 popisuje problém jako sled technických detailů a úryvků kódu bez shrnutí na začátku. Opus 5.5 stejnou chybu (chybné zahrnutí posledního dne měsíce do fakturačního období kvůli chybě v refaktoringu) otevírá jednou větou shrnující dopad – kolik peněz to firmě stojí a odkud přesně problém pochází – a teprve pak rozvádí technické detaily. Podle Anthropicu je to důsledek širší změny komunikačního stylu modelu: řadí nejdůležitější informaci na začátek, méně používá žargon a svérázné obraty a lépe dodržuje zadaná pravidla psaní. Firma Ramp v citaci uvádí, že objemný a těžko sledovatelný výstup byl jejich největší frustrací s dosavadními špičkovými modely a Opus 5.5 to řeší.

Ceny a dostupnost

Srovnání cen (zdroj: Anthropic)

UkazatelOpus 5.5Opus 5
Čtení z cache (za milion tokenů)0,20 $0,50 $
Vstupní tokeny (za milion)4 $5 $
Výstupní tokeny (za milion)20 $25 $
Zápis do cache (za milion)5 $6,25 $

Rychlý režim (fast mode) je dostupný v Claude Code a na Claude Platform s rychlostí až 2,5násobnou, za 8 dolarů za milion vstupních a 40 dolarů za milion výstupních tokenů.

Model je dostupný na všech hlavních platformách včetně Amazon Web Services, Google Cloud a Microsoft Azure, na Claude Platform pod označením claude-opus-5-5.

Co to znamená v praxi

Pro firmy, které Claude používají na programátorské nebo agentní úlohy, přináší Opus 5.5 podle zveřejněných čísel dvě věci najednou: nižší cenu za token a menší spotřebu tokenů na stejnou úlohu díky adaptivnímu myšlení. Opakovaný vzorec napříč referencemi zákazníků je, že i na nejnižší úrovni výpočetního úsilí model dosahuje srovnatelných nebo lepších výsledků, než jaké Opus 5 dosahoval na nejvyšší úrovni – to je důvod, proč zákazníci hlásí úspory 40 až 60 % při zachování nebo zlepšení přesnosti.

Pro úlohy, na kterých Opus 5.5 i na vyšší úrovni úsilí neuspěje, zůstává k dispozici dražší model Fable 5.1 určený pro nejnáročnější úlohy s dlouhým nepřerušovaným během. Opus 5 zůstává v nabídce pro firmy, které na něm mají postavené existující aplikace a chtějí přechod nejdřív otestovat na známých případech.

Časté otázky

Znamená „pacing the frontier“, že Anthropic zpomaluje vývoj modelů?

Podle popisu v oznámení jde o zásadu, že bezpečnostní postupy mají předbíhat schopnosti modelů, ne o zpomalení vydávání produktů. Firma zároveň otevřeně pracuje na dvou liniích – zdokonalování postupů pro současné modely a přípravě na výrazně schopnější modely, u kterých dnešní opatření podle vlastního vyjádření nemusí stačit.

Co znamená pokles pokusů o obcházení bezpečnostních hranic o 85 %?

Jde o výsledek nové interní zkoušky zaměřené na sklon modelu překračovat nastavené hranice svého chování. Anthropic uvádí, že Opus 5.5 se o tento druh chování pokoušel výrazně méně často než Opus 5 nebo Claude Mythos 5.1, a všechny zaznamenané pokusy byly nízké závažnosti a model je sám nahlásil.

Můžu Opus 5.5 použít na úlohy z kybernetické bezpečnosti?

Běžné opravy chyb v rámci vývojového cyklu ano. Většina úloh přímo spojených s kybernetickou bezpečností se ale podle Anthropicu automaticky přesměruje na starší model Opus 4.8, pokud nemá uživatel ověřený přístup přes rozšířený Cyber Verification Program.

Co je destilační útok a proč ho Anthropic řeší u tohoto modelu?

Jde o techniku, kdy útočník pomocí velkého počtu falešných účtů postupně vytěží schopnosti modelu a poskládá z nich vlastní kopii bez bezpečnostních prvků. Opus 5.5 proti tomu nasazuje opatření „preserved thinking“, které znemožňuje upravovat dřívější kontext modelu za účelem vytěžení jeho interního uvažování; platí pro API účty založené od 31. 8. 2026.

Jsou čísla o úsporách nákladů od zákazníků nezávisle ověřená?

Ne, jde o citace a čísla, která firmy samy poskytly Anthropicu do jeho oznámení na základě vlastního testování, nikoli o nezávislý audit třetí stranou. Bezpečnostní hodnocení modelu naproti tomu podle Anthropicu procházelo i externími organizacemi METR a Frontier Design.

Dá se Opus 5.5 provozovat s vypnutým režimem myšlení kvůli úspoře nákladů?

Ne. Anthropic uvádí, že stejně jako u Fable 5.1 už není možné model provozovat s vypnutým režimem „myšlení“ – úsporu tak zajišťuje jen nižší výchozí úroveň výpočetního úsilí (adaptivní myšlení), ne jeho úplné vypnutí.

Zdroje

  • Anthropic: Introducing Claude Opus 5.5 (oficiální oznámení, 22. 9. 2026, včetně System Card a zákaznických referencí) – anthropic.com/claude-opus-5-5
  • The Rundown AI: Claude Opus 5.5 vs Opus 5 vs Fable 5.1: Which Model Should You Use? – app.therundown.ai/guides/claude-opus-5-5-vs-opus-5-vs-fable-5-1
  • Anthropic: Introducing Claude Opus 5 (24. 7. 2026) – anthropic.com/news/claude-opus-5
  • #anthropic
  • #claude
  • #opus
  • #opus 5.5
  • #ai

ČTĚTE DÁL

Související články

Zpět do novinek
AI a modely

OpenAI uvedl GPT-6 Sol a Luna: poloviční cena a méně chyb než generace 5.6

OpenAI 22. 9. 2026 rozšířil svou nejnovější generaci modelů o dvě menší varianty: GPT-6 Sol a GPT-6 Luna. Doplňují tak model GPT-6 Astra, který firma vydala začátkem měsíce jako svůj nejschopnější model. Nové modely stojí polovinu ceny generace 5.6 a podle OpenAI dělají výrazně méně věcných chyb. Oznámení přišlo pouhých 90 minut po vydání aktualizované verze Opus 5.5 od konkurenčního Anthropicu – ukázka, jak těsně si oba giganty aktuálně konkurují.

Redakce Lernety12 min čtení
AI a modely

Amazon zablokoval Muse od Mety. Válka o agentní nákupy začala už dřív

V neděli večer začali uživatelé AI agenta Muse od Mety při pokusu nakoupit na Amazonu dostávat chybovou hlášku: přístup neautorizovaného AI agenta porušuje podmínky užívání Amazonu. Není to první případ, protože Amazon už dříve žaloval Perplexity kvůli jejímu prohlížeči Comet a zablokoval i přístupy OpenAI. Shrnujeme, co se stalo o víkendu, proč na tom Amazonu záleží a jak vypadá širší spor o to, kdo bude AI agentům otevírat dveře k nákupu.

Redakce Lernety10 min čtení
AI a modely

Jev: nový model, který nic nenapíše, jen za vás buderozhodovat

Firma TypeSafe AI, kterou založil bývalý výzkumník OpenAI a spoluautor ChatGPT a RLHF Diego Almeida, představila model jménem Jev. Nejde o další chatovací asistent – Jev negeneruje text, ale na sadu otázek vrací strukturované rozhodnutí s pravděpodobností a mírou jistoty. Shrnujeme, co je o modelu k 20. 9. 2026 ověřeno, výhradně podle anglických zdrojů (MindStudio.ai, Flaviocopes.com, Experientiallabs.ai, Vercel.com).

Redakce Lernety15 min čtení