2026. szeptember 22. · Anthropic bejelentés

Claude Opus 5.5

A Claude ma az X-en bejelentette a Claude 5.5 család első modelljét. A cég szerint a legtöbb feladaton Claude Fable 5.1 szintjén teljesít, miközben az Opus 5-nél nagyjából 40 százalékkal olcsóbban futtatható.

Miről szól a bejelentés?

A Claude az X-en egy nyolc posztból álló szálat tett közzé. A nyitó poszt mellett egy 20 másodperces brandvideó van (földgörbület, textúrák, kéziratok, a végén a Claude-logó és a „more to discover” felirat). A szálban táblázatok és költség–teljesítmény grafikonok is szerepelnek. Elon Musk egy szóval reagált: „Congrats!”

40%olcsóbb tipikus terhelésen, mint az Opus 5
30%+gyorsabb kimenet, mint az Opus 5
$4 / $20input / output ár millió tokenenként
1Mtokenes kontextusablak, 128K max kimenet

1. A modell helye a családban

„Introducing Claude Opus 5.5, the first model in our new Claude 5.5 family. It performs at the level of Claude Fable 5.1 for most tasks, and costs 40% less to run than Opus 5.”

Az Opus a Claude háromszintű kínálatának legerősebb, legdrágább ága. A Sonnet a közép, a Haiku a gyors és olcsó. Az Anthropic szerint a Sonnet 5.5 és a Haiku 5.5 a következő hetekben jön, hasonló jellegű javulással.

Ez az első modellkiadás azóta, hogy a cég a frontier ütemezését kérte (pacing the frontier): vagyis hogy a laborok ne pörögjenek vakon tovább a képességekkel, hanem hagyjanak időt a biztonsági gyakorlatnak. A modellt külső értékelők is nézték megjelenés előtt, köztük a METR és a Frontier Design.

2. Teljesítmény: kódolás, tudásmunka, számítógép-használat

„Opus 5.5 is a major step up from Opus 5, leading on agentic coding, computer use, and knowledge work.”

A cég szerint az Opus 5.5 nem kis iteráció, hanem érezhető ugrás a komplex, hosszú futású ügynöki munkában. Példák a hivatalos anyagból:

Claude Opus 5.5 benchmark táblázat
Az X-szál első nagy ábrája: összehasonlító benchmarktábla az Opus 5.5, Fable 5.1, Opus 5, GPT-6 Astra és GPT-5.6 Sol között. A rózsaszín cellák az Opus 5.5 győzelmei, a szürkék a konkurencia győzelmei.

A táblázat számai röviden

Teszt Opus 5.5 Fable 5.1 Opus 5 GPT-6 Astra GPT-5.6 Sol
Agentic coding · Terminal-Bench 4.0 66,4% 55,8% 52,3% 57,9% 37,3%
Agentic coding · FrontierCode v1.1 54,4% 50,3% 48,0% 53,3% 47,5%
Agentic coding · CursorBench 4.0 57,8% 51,8% 46,6% 41,7%
Tudásmunka · GDPval-AA v2.1 (Elo) 1846 1735 1708 1542 1588
Üzleti workflow · AutomationBench 40,0% 31,4% 26,9% 41,4% 28,8%
Többterületes gondolkodás · Humanity’s Last Exam (eszközzel) 67,7% 65,6% 63,6% 57,2%
Tudományos ügynök · Terminal-Bench-Science 0.1 58,7% 52,6% 29,0% 64,6% 22,4%
Számítógép-használat · OSWorld 2.0 (partial) 81,8% 80,7% 74,0%
Grafikonfelismerés · Chartography (eszközzel) 89,0% 88,4% 83,4%

Fontos lábjegyzet az ábráról: az Opus 5.5 eredményei általában adaptive thinking és max effort beállításon születtek, éles védőkorlátokkal. Ha a safeguard közbelépett, a kiberfeladatokat Opus 4.8-ra, a biológiát és bizonyos frontier LLM-fejlesztési feladatokat Opus 5-re irányították. Ez valószínűleg lefelé húzza az Opus 5.5 pontszámát ezeken a teszteken. Az AutomationBenchet a Zapier futtatta fallback modell nélkül, ezért a safeguard-beavatkozások sikertelenségnek számítottak.

3. Ár: kevesebb számítási igény, olcsóbb token

„Opus 5.5 requires less compute to serve than Opus 5, and its pricing reflects that. Our tests show that at default settings it will cost 40% less than Opus 5 on typical workloads.”

Nemcsak a listaár csökkent, hanem a modell kiszolgálása is olcsóbb lett. A tipikus, hosszú ügynöki munkánál a cache olvasás a költség nagy része. Ott a csökkenés a legnagyobb.

Opus 5.5 és Opus 5 ártáblázat
Az X-szál ártáblázata millió tokenenként. Input: 5 dollárról 4-re (mínusz 20%). Output: 25 dollárról 20-ra (mínusz 20%). Cache olvasás: 0,50 dollárról 0,20-ra (mínusz 60%). Cache írás: 6,25 dollárról 5-re.

4. A lényeg a grafikonokon: olcsóbban éri el a frontier szintet

„At its default effort setting, Opus 5.5 delivers frontier results for a fraction of the cost per task, often beating other models running at their highest settings. It also generates output more than 30% faster than Opus 5.”

Az X-szál négy költség–teljesítmény ábrát rakott egymás mellé. A vízszintes tengely mindenhol a feladat költsége logaritmikus skálán, a függőleges a pontszám. Az Opus 5.5 görbéje (narancs) tipikusan balra-fölfelé van: ugyanazt vagy jobbat olcsóbban hozza.

AutomationBench költség-teljesítmény
Üzleti workflow-k (AutomationBench). Az Opus 5.5 már alacsony effortön is nagyjából 23 százalékot hoz olcsón, maximum effortön nagyjából 40 százalékot. A GPT-6 Astra a csúcson kicsit fölé megy (kb. 41%), de drágábban. Az Opus 5 görbéje végig alatta marad.
FrontierCode költség-teljesítmény
Agentic coding, FrontierCode v1.1. Az Opus 5.5 közepes effortön már kb. 55 százalék körül van, viszonylag olcsón. A GPT-6 Astra és a Fable 5.1 csak jóval magasabb költségen ér fel hasonló tartományba. Az Anthropic állítása: alap effortön nagyjából az Astra költségének 20 százalékáért veri azt FrontierCode-on.
GDPval-AA költség-teljesítmény
Valós tudásmunka, GDPval-AA v2.1 Elo. Az Opus 5.5 max effortön 1846 Elo, a Fable 5.1 kb. 1735, az Opus 5 kb. 1708. A görbe már közepes effortön is a többiek fölött van.
Terminal-Bench költség-teljesítmény
Agentic terminal coding, Terminal-Bench 4.0. Az Opus 5.5 high / xhigh / max tartományban 64–67 százalék körül van, miközben az Astra kb. 58 százalék, a Fable 5.1 és az Opus 5 50–56 százalék között. A cég szerint itt az Astrával nagyjából azonos szintet az Astra költségének kb. 40 százalékáért hozza.

5. Kommunikáció: kevesebb zsargon, a lényeg elöl

„Opus 5.5 communicates more naturally, addressing some of the most common feedback we heard on Opus 5. It puts the most important information up front and follows the writing rules you give it, which makes long sessions easier to follow.”

Ez a bejelentés egyik leglátványosabb „emberi” állítása. Az Opus 5-öt sokan okosnak, de terjengősnek és zsargonosnak tartották. Az 5.5 a cég szerint:

Opus 5 és Opus 5.5 írási stílus összehasonlítás
Ugyanaz a hibakeresési feladat két modellválaszban. Balra az Opus 5: „What I found”, utána kódrészletek, a lényeg később derül ki. Jobbra az Opus 5.5: már a címben ott van a konklúzió („The extra drop is a bug in the billing refactor”), majd dollárösszegekkel, világos „mi változott” blokkal magyaráz.

6. Biztonság és alignment

A második poszt külön kiemeli: a legátfogóbb belső alignment-teszten (automated behavioral audit, közel 2000 szcenárió) ez a legerősebb modelljük eddig.

Az Anthropic maga is írja: a modell gyanakszik az értékelésre, a valós világban nehéz mindent elkapni, és a hosszabb vagy lehetetlen feladatokon vannak korlátok. A részletek a System Cardban vannak.

7. Elérhetőség és limitmódosítás

„One more thing: we’re increasing five-hour usage limits on Pro, Max, and Team plans. We’re also providing subscription users a rate limit reset, which you can save and use whenever you choose.”

Ez a szál záró, „one more thing” posztja, és engagementben az egyik legerősebb. Gyakorlatban:

A szál egy hivatalos írásra mutat: anthropic.com/claude-opus-5-5

8. Amit a szál nem ír ki, de a termékoldal igen

Ezek nem külön posztok, de a teljes képhez kellenek, mert a bejelentés ezekre hivatkozik.

Egymondatos mérleg

Az Anthropic üzenete nem az, hogy megvan a világ legokosabb modellje minden dimenzióban, hanem az, hogy az Opus-vonal most Fable-közeli munkaminőséget ad jóval olcsóbban és gyorsabban, tisztább stílussal, szigorúbb alignment-számmal, és közben a felhasználói limiteken is engedtek. A versenytársak néhány üzleti és tudományos padon még előtte járnak. A kódolós és tudásmunkás padokon a cég saját mérése szerint az Opus 5.5 vezet, ráadásul alacsonyabb dollár per feladat mellett.

Gyakori kérdések a Claude Opus 5.5-ről

Mi az a Claude Opus 5.5?

Az Anthropic 2026. szeptember 22-én bejelentett új nagy nyelvi modellje, a Claude 5.5 modellcsalád első tagja. Az Opus a Claude kínálat legerősebb ága; a cég szerint az Opus 5.5 a legtöbb feladaton Claude Fable 5.1 szinten teljesít, miközben az Opus 5-nél 40 százalékkal olcsóbban futtatható.

Mennyibe kerül a Claude Opus 5.5 az API-ban?

4 dollár millió input tokenenként és 20 dollár millió output tokenenként (az Opus 5-nél 5 és 25 dollár volt). A cache olvasás 0,20 dollár, a cache írás 5 dollár millió tokenenként. Fast módban 8 / 40 dollár, csak USA-beli inferenciával 1,1-szeres ár. Az API modellazonosító: claude-opus-5-5.

Miben jobb az Opus 5.5 az Opus 5-nél?

A cég saját mérései szerint az ügynöki kódolásban (Terminal-Bench 4.0: 66,4% a 52,3% helyett), a tudásmunkában (GDPval-AA: 1846 Elo az 1708 helyett) és a számítógép-használatban (OSWorld 2.0: 81,8%) lép előre, több mint 30 százalékkal gyorsabban ad kimenetet, tömörebben és kevesebb zsargonnal kommunikál, és erősebb az alignment-teszteken.

Hol érhető el a Claude Opus 5.5?

A Claude Pro, Max, Team és Enterprise csomagokban, fejlesztőknek pedig a Claude API-n, Amazon Bedrockon, Google Cloudon és Microsoft Azure / Foundryn. A bejelentés az ingyenes csomagról nem szól.

Mikor jön a Claude Sonnet 5.5 és a Haiku 5.5?

Az Anthropic szerint a következő hetekben, hasonló jellegű javulással, mint amit az Opus 5.5 hozott.

Változtak a Claude használati limitek?

Igen. A bejelentéssel együtt megemelték az ötórás használati limiteket a Pro, Max és Team csomagokon, és az előfizetők kapnak egy eltehető rate limit resetet, amit akkor váltanak be, amikor szükségük van rá.

Miben nem vezet az Opus 5.5?

Az AutomationBench üzleti workflow teszten (40,0% vs. 41,4%) és a Terminal-Bench-Science tudományos ügynökteszten (58,7% vs. 64,6%) a GPT-6 Astra még előtte jár a cég saját táblázata szerint.

Hogyan tovább

Ha a gyakorlatban is használnád, amit a Claude tud: az Affilion AI-n találsz ingyenes magyar tananyagokat, az AI Skill Mestercsomagban 30 kész, magyar nyelvű skillt, az AI Clubban pedig hetente frissülő anyagokat és közösséget, ahol kérdezhetsz is.

A Claude és a Claude Opus az Anthropic termékei. Ez független, magyar nyelvű összefoglaló, az Affilion AI nem áll kapcsolatban az Anthropickal. A számok a cég saját közléséből származnak, független mérés még nem készült.