A Claude Opus 4.8 az Anthropic új csúcsmodellje, amelyet a cég 2026. július 15-én jelentett be és tett azonnal elérhetővé. A frissítés az Opus 4.7-re épül, jobb ítélőképességet, négyszer megbízhatóbb kódolást és érdemben olcsóbb gyors módot hoz — mindezt változatlan alapáron. Ebben a cikkben végigvesszük, mi új benne, hogyan teljesít a benchmarkokon, mibe kerül, és kinek érdemes váltania rá.
A bejelentés érdekessége, hogy nem a nyers intelligenciát tolja tovább mindenáron, hanem az agentes munkára — a hosszan futó, autonóm feladatokra — élesíti a modellt. A számok alapján ez most az egyik legfontosabb frontier modell a piacon.
Miért fontos a Claude Opus 4.8 megjelenése?
Az Anthropic csúcsmodell-vonala, az Opus, hagyományosan a legnehezebb feladatokra készül: komplex kódolás, hosszú dokumentum-elemzés, több lépéses ágensfeladatok. A Claude Opus 4.8 ezen a vonalon lép tovább, és a fejlesztők egyik legégetőbb fájdalompontjára válaszol: a megbízhatóságra és a token-költségre.
A modell API-azonosítója claude-opus-4-8, és a bejelentés napjától elérhető. A verziószámozás jelzi, hogy ez inkubáció, nem teljes generációváltás — a következő, még erősebb modellosztály neve Claude Mythos lesz, ami jelenleg zárt tesztelés alatt áll.
A lényeg azonban nem a névben van. Az Opus 4.8 azt mutatja meg, hogy a frontier modellek versenye 2026 közepén már nem pusztán arról szól, ki tud „okosabb” választ adni, hanem arról, ki képes megbízhatóan, olcsón és felügyelet nélkül végigvinni egy egész munkafolyamatot.
Mi új a Claude Opus 4.8-ban?
A frissítés három nagy területen hoz kézzelfogható változást: ítélőképesség, megbízhatóság és fejlesztői funkciók. Az Anthropic saját megfogalmazása szerint a modell „észrevehetően jobb ítélőképességgel” dolgozik.
„A Claude Opus 4.8 a Claude Code-ban felteszi a megfelelő kérdéseket, észreveszi a saját hibáit, és visszautasítja a tervet, ha az nem megalapozott.” — Anthropic
A legfontosabb konkrét újítás a négyszeres megbízhatóság-javulás: az Opus 4.8 négyszer ritkábban engedi át a hibákat az általa írt kódban anélkül, hogy jelezné őket. Kevesebbet hallucinál, és hajlamosabb jelezni a saját bizonytalanságát — ez éles, éles környezetben komoly különbség.
Emellett három új, szintén a bejelentés napján induló funkció érkezett:
- Effort Control (erőfeszítés-szabályozás): a felhasználó eldöntheti, hogy a Claude mélyebben „gondolkodjon” a nehéz feladaton (Extra/xhigh, Max beállítás), vagy gyorsabban és token-takarékosabban válaszoljon. Az alapértelmezett „high” beállítás token-fogyasztásban az Opus 4.7-re hasonlít, de jobb eredményt ad. A funkció minden előfizetési csomagon elérhető.
- Dynamic Workflows (dinamikus munkafolyamatok): a Claude Code-ban research preview-ként elérhető funkció, amellyel a modell akár több száz párhuzamos subagentet koordinál egyetlen munkamenetben. Ez teljes kódalapú migrációkra teszi alkalmassá, a kimenetet pedig a meglévő tesztekkel ellenőrzi. Enterprise, Team és Max csomagban érhető el.
- Messages API frissítés: mostantól system bejegyzések helyezhetők el a messages tömbben, így a szabályok vagy a kontextus futás közben módosíthatók anélkül, hogy megtörne a prompt cache.
Hogyan teljesít a Claude Opus 4.8 a benchmarkokon?
A benchmark-számok mutatják meg legjobban, hol lépett előre a modell. Az Anthropic több független és belső tesztet is közölt, és ezek következetesen az agentes, valós feladatokra fókuszálnak.
Az Online-Mind2Web böngészési és számítógép-használati teszten az Opus 4.8 84%-ot ért el, ami komoly ugrás az Opus 4.7 és a versenytárs GPT-5.5 fölött. A Super-Agent benchmarkon ez volt az egyetlen modell, amely minden esetet elejétől a végéig sikeresen megoldott — azonos költségszinten megelőzve a korábbi Opus modelleket és a GPT-5.5-öt is.
„A Super-Agent benchmarkunkon egyedül a Claude Opus 4.8 tudott minden esetet elejétől a végéig sikeresen megoldani, legyőzve a korábbi Opus modelleket és az azonos költségű GPT-5.5-öt.” — Anthropic
A gyakorlati partneri visszajelzések ezt megerősítik. A Databricks Genie mérése szerint a modell 61%-kal olcsóbban dolgozza fel a PDF-eket, diagramokat és strukturálatlan adatokat, mint az Opus 4.7 — ez a multimodális képességek javulásának köszönhető. A Legal Agent benchmarkon az Opus 4.8 első modellként lépte át a 10%-os átmeneti arányt az „all-pass standard” teszten. A Cognition Devin csapata szerint a modell tisztábban használja az eszközöket, és javítja az Opus 4.6 és 4.7 hibáit, például a komment-bőbeszédűséget.
Fontos a gyengeségeket is látni: az „all-pass” jogi teszten a 10% feletti arány jelzi, hogy a legszigorúbb, hibátlanságot követelő feladatoknál még bőven van tér a fejlődésre. Az Opus 4.8 nem hibátlan, csak érdemben megbízhatóbb az elődjénél.
Árazás és elérhetőség: mennyibe kerül az Opus 4.8?
Az egyik legerősebb üzenet az árazás. Az Opus 4.8 alapára változatlan az elődjéhez képest:
Standard használat: 5 dollár / millió input token és 25 dollár / millió output token. Gyors mód (Fast Mode, 2,5x sebesség): 10 dollár / millió input token és 50 dollár / millió output token.
A gyors mód a legnagyobb árazási újítás: a korábbi modellek gyors módjához képest háromszor olcsóbb lett, miközben 2,5-szeres sebességgel fut. Ez azt jelenti, hogy az idő-kritikus, gyors visszajelzést igénylő workflow-k jelentősen olcsóbbá válnak.
A modell a bejelentés napjától elérhető az API-ban, valamint a claude.ai és a Cowork felületen az Effort Control funkcióval együtt. Az agentes funkciók egy része (Dynamic Workflows) egyelőre a magasabb szintű csomagokhoz kötött.
Kinek érdemes váltania a Claude Opus 4.8-ra?
A modell profilja alapján a válasz egyértelmű: azoknak éri meg leginkább, akik hosszú, ágens-alapú feladatokat futtatnak, ahol a megbízhatóság és a token-hatékonyság közvetlenül pénzt ér.
A szoftverfejlesztőknek a négyszeres kód-megbízhatóság és a Dynamic Workflows a legfontosabb: kevesebb csendben átengedett hiba, kevesebb utólagos javítás. A kutatóknak és adatelemzőknek a 61%-kal olcsóbb dokumentum-feldolgozás közvetlen költségmegtakarítás. Aki pedig gyors, iteratív workflow-t épít, annak a harmadára csökkent gyors mód ára a döntő érv.
Ha viszont valaki csak alkalmi chatelésre, ötletelésre vagy egyszerű szövegírásra használja az AI-t, számára a váltás nem hoz látványos különbséget — az Opus 4.8 ereje a nehéz, soklépéses feladatokban mutatkozik meg. A modellválasztás mindig a valós használati mintától függ; erről részletesen írtunk a legjobb olcsó AI modellek 2026-os összehasonlításában.
5 döntéshozói következtetés az Opus 4.8-ból
- A megbízhatóság most a fő versenytényező: a négyszer ritkább csendes kódhiba vállalati környezetben közvetlenül csökkenti a review- és javítási költséget — ez fontosabb lehet, mint egy plusz benchmark-pont.
- Az agentes képesség a fejlesztői workflow új mércéje: a Dynamic Workflows és a több száz párhuzamos subagent teljes kódmigrációkat tesz automatizálhatóvá, amit korábban emberi csapat végzett.
- A token-költség tervezhetőbb lett: az Effort Control révén a csapat maga döntheti el, mennyit „gondolkodjon” a modell, így a token-pazarlás szabályozható tétellé válik.
- A gyors mód olcsóbbá tette az iterációt: a harmadára csökkent ár miatt a gyors, sok lépéses fejlesztői ciklusok költsége érdemben leesett.
- Készülni kell a Mythos-generációra: az Opus 4.8 átmeneti lépcső — a Claude Mythos érkezése a következő hetekben újra átrendezheti a frontier modellek erőviszonyait.
Az Opus 4.8 a Mythos-generáció előszobája
A bejelentés végén az Anthropic egyértelművé tette az irányt: a cég egy „az Opusnál is magasabb intelligenciájú modellosztály” kiadását tervezi. Ennek neve Claude Mythos, és a Mythos Preview jelenleg zárt kiberbiztonsági tesztelés alatt áll a Project Glasswing keretében.
A modellosztály állítólag annyira erős, hogy komoly kiberbiztonsági kockázatot jelent — ezért tesztelik zárt körben, mielőtt a megfelelő biztonsági korlátok elkészültével a következő hetekben mindenki számára elérhetővé válna. Az Alignment csapat szerint az Opus 4.8 félrevezetési és visszaélési arányai már a Mythos Preview szintjére estek vissza.
Az Opus 4.8 tehát nem a végállomás, hanem egy jól időzített lépcsőfok: megbízhatóbb, olcsóbb gyors móddal és erősebb agentes képességekkel felkészíti a piacot arra, ami néhány héten belül érkezik. Aki most építi az AI-stratégiáját, annak érdemes ezt a menetrendet is beárazni.
Kapcsolódó elemzésünkben részletesen bemutatjuk: Claude Sonnet 5: 60%-kal olcsóbb kódoló AI-modell. További friss modell-elemzésekért iratkozz fel az AI Hírek hírlevelére.