Az Anthropic meglepetésszerűen kiadta a Claude Opus 5.5 nyelvi modellt, alig egy órával megelőzve az OpenAI válaszlépését, és ezzel új árháborút robbantott ki a csúcskategóriás mesterséges intelligenciák piacán – derül ki Simon Willison technikai elemzéséből és a The Decoder beszámolójából. Az új zászlóshajó egyszerre csökkenti a tokenárakat, hoz rekord pontszámokat a benchmarkokon, és igyekszik felszámolni a modellt korábban ért stilisztikai kritikákat.
A korábbi generációk az Opus 4.5-től az 5.0-ig egységesen 5 dolláros bemeneti és 25 dolláros kimeneti árat használtak egymillió tokenenként; az Opus 5.5 ezt 20 százalékkal vágta vissza, 4 dolláros bemeneti és 20 dolláros kimeneti díjszabást bevezetve. Ennél is jelentősebb az olvasási gyorsítótár költségének 60 százalékos zuhanása, ami a hosszú, többfordulós ágenses folyamatoknál hoz komoly megtakarítást, ahol a bemeneti tokenek több mint 90 százaléka gyorsítótárból töltődik be. Az előfizetők 5 órás kvótája 20 százalékkal bővült, miközben az alig egy órával később debütáló GPT-6 Sol és Luna modellek még agresszívabb árazással próbálják ellensúlyozni az Anthropic lépését.
Benchmark rekordok és a Claudish stílus megszüntetése
A fejlesztők közvetlenebb fogalmazást ígérnek a korábbi modoros, körmondatokba bonyolódó szövegalkotás helyett: a lényeges információk előrekerülnek, a szakzsargon ritkul, amiről Thariq Shihipar termékfejlesztő is beszámolt. A képességek terén az Artificial Analysis Intelligence Index mérése szerint az Opus 5.5 elérte az 58-as abszolút csúcsértéket, tízből hat fő kategóriában átvéve a vezetést. A Humanity’s Last Exam teszten 61,4 százalékot ért el, megelőzve a Fable 5.1 korábbi 59,1 százalékos csúcsát, a szoftveres Terminal-Bench 4.0 alatt pedig 59,6 százalékos holtverseny alakult ki a GPT-6 Astra csúcsmodellel, ami 11 pontos javulás a korábbi Claude Opus 5 mérésekhez képest.

Gyakorlati tesztek és a 128 ezer tokenes limit
A valós alkalmazási tesztek ugyanakkor rávilágítottak egy technikai sajátosságra: maximális gondolkodási fokozaton a modell hajlamos túlbonyolítani a feladatokat. Simon Willison mérései szerint az összetett SVG-generálás során az Opus 5.5 kétszer egymás után futott bele a 128 000 kimeneti tokenes kemény korlátba, ami feladatonként 20 perces futásidő mellett 2,56 dolláros felesleges költséget eredményezett válaszadás nélkül. A fejlesztői környezetekben, például a Claude Code felületén ugyanakkor a közepes és magas érvelési szintek megbízhatóan működnek.
Az új kiadás szigorúbb védelmi réteget kapott: a biológiai vagy kiberbiztonsági kockázatot hordozó kéréseket automatikusan az Opus 5 vagy Opus 4.8 verziókhoz irányítja át a rendszer, amíg a laborok az ellenőrzött hozzáférést felülvizsgálják. A modell megkapta a Preserved Thinking funkciót is, amely megakadályozza, hogy külső szereplők a korábbi kontextus manipulálásával sajátítsák el a gondolkodási láncot, amire a korábbi jogosulatlan katonai és desztillációs incidensek miatt volt szükség. Az európai uniós AI Act előírásainak megfelelően a gondolkodási mód többé nem kapcsolható ki teljesen, és a felhős infrastruktúrákban elérhetővé vált a Zero Data Retention adatvédelmi garancia.
A költségcsökkentés és a teljesítménynövekedés mögött a kontextusfüggő gyorsítótárazás finomhangolása és a tokenenkénti energiafelhasználás hardverszintű optimalizációja húzódik meg.