A Claude ma az X-en bejelentette a Claude 5.5 család első modelljét. A cég szerint a legtöbb feladaton Claude Fable 5.1 szintjén teljesít, miközben az Opus 5-nél nagyjából 40 százalékkal olcsóbban futtatható.
A Claude az X-en egy nyolc posztból álló szálat tett közzé. A nyitó poszt mellett egy 20 másodperces brandvideó van (földgörbület, textúrák, kéziratok, a végén a Claude-logó és a „more to discover” felirat). A szálban táblázatok és költség–teljesítmény grafikonok is szerepelnek. Elon Musk egy szóval reagált: „Congrats!”
„Introducing Claude Opus 5.5, the first model in our new Claude 5.5 family. It performs at the level of Claude Fable 5.1 for most tasks, and costs 40% less to run than Opus 5.”
Az Opus a Claude háromszintű kínálatának legerősebb, legdrágább ága. A Sonnet a közép, a Haiku a gyors és olcsó. Az Anthropic szerint a Sonnet 5.5 és a Haiku 5.5 a következő hetekben jön, hasonló jellegű javulással.
Ez az első modellkiadás azóta, hogy a cég a frontier ütemezését kérte (pacing the frontier): vagyis hogy a laborok ne pörögjenek vakon tovább a képességekkel, hanem hagyjanak időt a biztonsági gyakorlatnak. A modellt külső értékelők is nézték megjelenés előtt, köztük a METR és a Frontier Design.
„Opus 5.5 is a major step up from Opus 5, leading on agentic coding, computer use, and knowledge work.”
A cég szerint az Opus 5.5 nem kis iteráció, hanem érezhető ugrás a komplex, hosszú futású ügynöki munkában. Példák a hivatalos anyagból:
| Teszt | Opus 5.5 | Fable 5.1 | Opus 5 | GPT-6 Astra | GPT-5.6 Sol |
|---|---|---|---|---|---|
| Agentic coding · Terminal-Bench 4.0 | 66,4% | 55,8% | 52,3% | 57,9% | 37,3% |
| Agentic coding · FrontierCode v1.1 | 54,4% | 50,3% | 48,0% | 53,3% | 47,5% |
| Agentic coding · CursorBench 4.0 | 57,8% | 51,8% | 46,6% | – | 41,7% |
| Tudásmunka · GDPval-AA v2.1 (Elo) | 1846 | 1735 | 1708 | 1542 | 1588 |
| Üzleti workflow · AutomationBench | 40,0% | 31,4% | 26,9% | 41,4% | 28,8% |
| Többterületes gondolkodás · Humanity’s Last Exam (eszközzel) | 67,7% | 65,6% | 63,6% | 57,2% | – |
| Tudományos ügynök · Terminal-Bench-Science 0.1 | 58,7% | 52,6% | 29,0% | 64,6% | 22,4% |
| Számítógép-használat · OSWorld 2.0 (partial) | 81,8% | 80,7% | 74,0% | – | – |
| Grafikonfelismerés · Chartography (eszközzel) | 89,0% | 88,4% | 83,4% | – | – |
Fontos lábjegyzet az ábráról: az Opus 5.5 eredményei általában adaptive thinking és max effort beállításon születtek, éles védőkorlátokkal. Ha a safeguard közbelépett, a kiberfeladatokat Opus 4.8-ra, a biológiát és bizonyos frontier LLM-fejlesztési feladatokat Opus 5-re irányították. Ez valószínűleg lefelé húzza az Opus 5.5 pontszámát ezeken a teszteken. Az AutomationBenchet a Zapier futtatta fallback modell nélkül, ezért a safeguard-beavatkozások sikertelenségnek számítottak.
„Opus 5.5 requires less compute to serve than Opus 5, and its pricing reflects that. Our tests show that at default settings it will cost 40% less than Opus 5 on typical workloads.”
Nemcsak a listaár csökkent, hanem a modell kiszolgálása is olcsóbb lett. A tipikus, hosszú ügynöki munkánál a cache olvasás a költség nagy része. Ott a csökkenés a legnagyobb.
„At its default effort setting, Opus 5.5 delivers frontier results for a fraction of the cost per task, often beating other models running at their highest settings. It also generates output more than 30% faster than Opus 5.”
Az X-szál négy költség–teljesítmény ábrát rakott egymás mellé. A vízszintes tengely mindenhol a feladat költsége logaritmikus skálán, a függőleges a pontszám. Az Opus 5.5 görbéje (narancs) tipikusan balra-fölfelé van: ugyanazt vagy jobbat olcsóbban hozza.
„Opus 5.5 communicates more naturally, addressing some of the most common feedback we heard on Opus 5. It puts the most important information up front and follows the writing rules you give it, which makes long sessions easier to follow.”
Ez a bejelentés egyik leglátványosabb „emberi” állítása. Az Opus 5-öt sokan okosnak, de terjengősnek és zsargonosnak tartották. Az 5.5 a cég szerint:
A második poszt külön kiemeli: a legátfogóbb belső alignment-teszten (automated behavioral audit, közel 2000 szcenárió) ez a legerősebb modelljük eddig.
Az Anthropic maga is írja: a modell gyanakszik az értékelésre, a valós világban nehéz mindent elkapni, és a hosszabb vagy lehetetlen feladatokon vannak korlátok. A részletek a System Cardban vannak.
„One more thing: we’re increasing five-hour usage limits on Pro, Max, and Team plans. We’re also providing subscription users a rate limit reset, which you can save and use whenever you choose.”
Ez a szál záró, „one more thing” posztja, és engagementben az egyik legerősebb. Gyakorlatban:
A szál egy hivatalos írásra mutat: anthropic.com/claude-opus-5-5
Ezek nem külön posztok, de a teljes képhez kellenek, mert a bejelentés ezekre hivatkozik.
Az Anthropic üzenete nem az, hogy megvan a világ legokosabb modellje minden dimenzióban, hanem az, hogy az Opus-vonal most Fable-közeli munkaminőséget ad jóval olcsóbban és gyorsabban, tisztább stílussal, szigorúbb alignment-számmal, és közben a felhasználói limiteken is engedtek. A versenytársak néhány üzleti és tudományos padon még előtte járnak. A kódolós és tudásmunkás padokon a cég saját mérése szerint az Opus 5.5 vezet, ráadásul alacsonyabb dollár per feladat mellett.
Az Anthropic 2026. szeptember 22-én bejelentett új nagy nyelvi modellje, a Claude 5.5 modellcsalád első tagja. Az Opus a Claude kínálat legerősebb ága; a cég szerint az Opus 5.5 a legtöbb feladaton Claude Fable 5.1 szinten teljesít, miközben az Opus 5-nél 40 százalékkal olcsóbban futtatható.
4 dollár millió input tokenenként és 20 dollár millió output tokenenként (az Opus 5-nél 5 és 25 dollár volt). A cache olvasás 0,20 dollár, a cache írás 5 dollár millió tokenenként. Fast módban 8 / 40 dollár, csak USA-beli inferenciával 1,1-szeres ár. Az API modellazonosító: claude-opus-5-5.
A cég saját mérései szerint az ügynöki kódolásban (Terminal-Bench 4.0: 66,4% a 52,3% helyett), a tudásmunkában (GDPval-AA: 1846 Elo az 1708 helyett) és a számítógép-használatban (OSWorld 2.0: 81,8%) lép előre, több mint 30 százalékkal gyorsabban ad kimenetet, tömörebben és kevesebb zsargonnal kommunikál, és erősebb az alignment-teszteken.
A Claude Pro, Max, Team és Enterprise csomagokban, fejlesztőknek pedig a Claude API-n, Amazon Bedrockon, Google Cloudon és Microsoft Azure / Foundryn. A bejelentés az ingyenes csomagról nem szól.
Az Anthropic szerint a következő hetekben, hasonló jellegű javulással, mint amit az Opus 5.5 hozott.
Igen. A bejelentéssel együtt megemelték az ötórás használati limiteket a Pro, Max és Team csomagokon, és az előfizetők kapnak egy eltehető rate limit resetet, amit akkor váltanak be, amikor szükségük van rá.
Az AutomationBench üzleti workflow teszten (40,0% vs. 41,4%) és a Terminal-Bench-Science tudományos ügynökteszten (58,7% vs. 64,6%) a GPT-6 Astra még előtte jár a cég saját táblázata szerint.
Ha a gyakorlatban is használnád, amit a Claude tud: az Affilion AI-n találsz ingyenes magyar tananyagokat, az AI Skill Mestercsomagban 30 kész, magyar nyelvű skillt, az AI Clubban pedig hetente frissülő anyagokat és közösséget, ahol kérdezhetsz is.
A Claude és a Claude Opus az Anthropic termékei. Ez független, magyar nyelvű összefoglaló, az Affilion AI nem áll kapcsolatban az Anthropickal. A számok a cég saját közléséből származnak, független mérés még nem készült.