Claude Opus 5.5 má byť rýchlejší a lacnejší
Anthropic predstavil Claude Opus 5.5, svoj nový model určený najmä na náročné programovanie, agentické úlohy a odbornú prácu. Novinka má byť rýchlejšia a lacnejšia než Opus 5 a podľa benchmarkov Anthropicu prekonáva aj Fable 5.1.
Opus 5.5 je zároveň prvým modelom, ktorý Anthropic vydáva po predstavení svojho prístupu pacing the frontier. Firma chce pri ďalšom vývoji výkonnejších modelov intenzívnejšie prepájať rast ich schopností s bezpečnostným testovaním a externým hodnotením. Pred vydaním nového Opusu preto model testovali aj nezávislé externé organizácie.
Opus 5.5 prekonáva Fable 5.1 vo všetkých benchmarkoch
Anthropic zverejnil výsledky deviatich benchmarkov zameraných na programovanie, odbornú prácu, reasoning, používanie počítača či vedecký výskum. Claude Opus 5.5 dosiahol vyššie skóre ako Fable 5.1 vo všetkých deviatich testoch.
Medzi najvýraznejšie výsledky patria:
- Terminal-Bench 4.0 pre agentické programovanie: 66,4 % oproti 55,8 % pri Fable 5.1,
- FrontierCode v1.1: 54,4 % oproti 50,3 %,
- GDPval-AA pre odbornú znalostnú prácu: 1 846 oproti 1 735,
- Humanity’s Last Exam s nástrojmi: 67,7 % oproti 65,6 %,
- OSWorld 2.0 pre používanie počítača: 81,8 % oproti 80,7 %.
Pri porovnaní s GPT-6 Astra má Opus 5.5 vyšší výsledok v štyroch zo šiestich benchmarkov, v ktorých Anthropic uvádza skóre pre oba modely. Astra zostáva vyššie v benchmarku AutomationBench pre business workflowy a v Terminal-Bench-Science pre agentický vedecký výskum.
Samotný Anthropic však upozorňuje, že rozdiely v benchmarkoch už nemusia presne vystihovať rozdiel pri reálnom používaní modelov. Firma uvádza, že pri vlastnej práci vníma rozdiel medzi Opus 5.5 a Fable 5.1 ako menší, než naznačuje tabuľka výsledkov.
Silnou stránkou zostáva agentické programovanie
Opus 5.5 je zameraný najmä na dlhšie úlohy, pri ktorých model samostatne pracuje s veľkým množstvom kódu, nástrojmi a viacerými krokmi.
Anthropic uvádza napríklad interný test, v ktorom mali Opus 5.5 a Fable 5.1 prepísať HAProxy z jazyka C do Rustu. Obe verzie zvládli takmer všetky pôvodné regresné testy, Opus 5.5 však úlohu dokončil za 9,5 hodiny oproti 12 hodinám pri Fable 5.1 a podľa Anthropicu stál o 51 % menej.
Pri inom teste dokázal Opus 5.5 analyzovať a upraviť približne 200-tisíc riadkov kódu za menej ako tri hodiny. Opus 5 potreboval na rovnakú úlohu viac ako 20 hodín a 2,5-násobne viac tokenov.
Tieto výsledky pochádzajú z testovania Anthropicu a jeho early-access partnerov, preto ich nemožno automaticky preniesť na každý typ vývojárskej úlohy.
Opus 5.5 má byť približne o 40 % lacnejší
Výraznejšou zmenou oproti Opus 5 je cena a efektivita. Opus 5.5 stojí v API:
- USD 4 za milión vstupných tokenov,
- USD 20 za milión výstupných tokenov,
- USD 0,20 za milión tokenov pri čítaní z cache,
- USD 5 za milión tokenov pri zápise do cache.
Samotná cena vstupných a výstupných tokenov je teda o 20 % nižšia než pri Opus 5. Anthropic zároveň tvrdí, že model potrebuje na dokončenie úloh menej tokenov, takže pri typickom workloade má byť výsledná cena približne o 40 % nižšia.
Výstup má model generovať o viac ako 30 % rýchlejšie než Opus 5.
K dispozícii je aj Fast mode v Claude Code a Claude Platform, ktorý môže byť až 2,5-násobne rýchlejší. Cena je v tomto režime USD 8 za milión vstupných a USD 40 za milión výstupných tokenov.
Pacing the frontier
Opus 5.5 prichádza krátko po tom, ako CEO Anthropicu Dario Amodei verejne otvoril tému pacing the frontier, teda potreby prispôsobiť tempo vývoja najvýkonnejších AI systémov tomu, ako rýchlo dokážu firmy a verejné inštitúcie vybudovať mechanizmy na ich bezpečné používanie.
Pri Opus 5.5 Anthropic ešte vývoj modelu nespomaľoval. Zmenil však časť procesu pred jeho vydaním.
Model ešte pred spustením hodnotili externé organizácie METR a Frontier Design. Anthropic zároveň rozšíril vlastné bezpečnostné testovanie o dlhšie úlohy, úlohy bez možného riešenia a scenáre založené na reálnych incidentoch.
V internom automated behavioral audite, ktorý zahŕňa približne 2 000 simulovaných scenárov, dosiahol Opus 5.5 podľa Anthropicu najlepší výsledok spomedzi jeho doteraz testovaných modelov pri väčšine sledovaných prejavov nežiaduceho správania. Firma zároveň tvrdí, že model je odolnejší voči prompt injection útokom než Opus 5.
Ide však stále o výsledky hodnotenia, ktoré zverejňuje samotný majiteľ modelu. Externé testovanie má pri tejto generácii väčšiu úlohu, no neznamená to, že model alebo spôsob jeho nasadenia možno považovať za bezrizikový.
Dostupnosť Claude Opus 5.5
Claude Opus 5.5 je dostupný od 22. septembra 2026.
V aplikácii Claude ho môžu používať zákazníci plánov Pro, Max, Team a Enterprise. Pre vývojárov je dostupný cez Claude Platform pod označením claude-opus-5-5 a Anthropic ho sprístupnil aj cez Amazon Web Services, Google Cloud a Microsoft Azure.
Anthropic zároveň zvýšil päťhodinové usage limity pre Pro, Max, Team a vybrané Enterprise účty.
Opus 5.5 podporuje aj zero data retention a obsahuje opatrenia, ktoré Anthropic používa v súvislosti s požiadavkami európskeho AI Actu.
Sonnet 5.5 a Haiku 5.5 prídu neskôr
Opus 5.5 je prvým modelom novej série Claude 5.5. Anthropic už potvrdil, že Claude Sonnet 5.5 a Claude Haiku 5.5 plánuje predstaviť v najbližších týždňoch.
Pri nich chce firma použiť podobné zlepšenia v oblasti výkonu, efektivity aj bezpečnosti.
Opus 5.5 je zaujímavý nielen vyšším výkonom, ale aj kombináciou nižšej ceny, menšej spotreby tokenov a väčšieho dôrazu na externé testovanie pred vydaním. Práve pri dlhších agentických úlohách môže byť rozdiel v nákladoch a počte potrebných krokov prakticky dôležitejší než niekoľko percentuálnych bodov v benchmarku.