Az Anthropic 2026. szeptember 1-jén kiadta a Claude Fable 5.1 és a Mythos 5.1 modellt, és a frissítés legfontosabb száma nem egy benchmark, hanem egy árcédula: a cache-olvasás ára 75%-kal, 1 millió tokenenként 1 dollárról 0,25 dollárra esett, ami erősen ügynöki (agentic) munkaterhelésnél akár 45%-os effektív költségcsökkenést jelent. A két modell ugyanarra az alapmodellre épül, csak a védőkorlátok szintjében tér el — és mindkettő minden publikált teszten megelőzi a júliusi Claude Opus 5-öt.
Ez a kiadás nem klasszikus generációváltás. Az Anthropic három konkrét vállalati panaszra válaszol vele: drága a hosszú kontextusú ügynökfuttatás, nem tiszta, hova kerül a monitorozási adat, és túl gyakran akad be a biztonsági szűrő jóhiszemű kérdéseknél. Mindhárom pontra jött mérhető válasz.
Mi az új a Claude Fable 5.1-ben és a Mythos 5.1-ben
A két modell között nem képességbeli, hanem hozzáférési és védőkorlát-különbség van. A Fable 5.1 az általánosan elérhető változat: azonnal él az Anthropic API-n (claude-fable-5-1 modellnévvel), az Amazon Bedrockon, a Google Cloudon és a Microsoft Azure/Foundry platformon.
A Mythos 5.1 ezzel szemben korlátozott kiadás: átvilágított kiberbiztonsági és élettudományi szervezetek kapják meg a „Project Glasswing” programon keresztül, egyelőre az Egyesült Államokban. Ez a változat lazább korlátok mellett dolgozik olyan területeken, ahol a nyilvános modellnél az Anthropic nem vállalná a kockázatot.
A Claude-előfizetőknek is változik a hozzáférés logikája: a Pro és a standard Team/Enterprise ülőhelyek API-áron, kreditből használhatják az új modellt, míg a Max és a prémium ülőhelyek a heti limitjük legfeljebb 50%-áig férnek hozzá. Ha a limitek témája érdekel, erről korábban részletesen írtunk a Claude Code heti limitjének szigorításáról.
Benchmarkok: hol nagy az ugrás, és hol nem
A számok a kódolási és ügynöki feladatoknál a legmeggyőzőbbek. A Terminal-Bench-Science 0.1 teszten a Fable 5.1 52,6%-ot ért el a Fable 5 24,7%-ával szemben — vagyis nagyjából megduplázta az elődje eredményét. Ugyanezen a teszten az Opus 5 29,0%-on, a GPT-5.6 Sol pedig 22,4%-on áll.
Terminal-Bench-Science 0.1: Fable 5.1 52,6% · Opus 5 29,0% · Fable 5 24,7% · GPT-5.6 Sol 22,4%
A többi mérés is konzisztens irányba mutat:
- Terminal-Bench 4.0: 55,8% (Fable 5.1) a Fable 5 42,0%-ával és az Opus 5 52,3%-ával szemben. A Mythos 5.1 ugyanitt 60,9%-ot hoz. (Az Anthropic saját oldala a 60,9%-ot Mythos 5.1-ként közli, míg a sajtó a Fable 5.1-et 55,8%-on hozza — érdemes a két számot nem összekeverni.)
- CursorBench 3.2.0: 73,4% vs. a Fable 5 70,5%-a — itt már csak finomhangolásnyi a különbség.
- Humanity’s Last Exam: 60,9% eszközök nélkül, 65,0% eszközökkel.
- GDPval-AA v2 (valós tudásmunka): 1 853 pont, szemben a Fable 5 1 723 és az Opus 5 1 824 pontjával.
- AutomationBench: 31,4% vs. a Fable 5 17,1%-a; az Opus 5 26,9%-on áll.
Az ügyfélteszteknél is látszik a különbség. A Browserbase mérésében a Fable 5.1 a legnehezebb böngésző-ügynök benchmarkon a feladatok 82%-át teljesítette — az Opus 5 74%-ával és a Fable 5 mindössze 57%-ával szemben. A Ramp pedig egy 38 órás, felügyelet nélküli gépi tanulási futást jelentett, amelyben a modell önállóan újraértékelte a megközelítését, és hat új kísérletet indított.
Az Anthropic tudományos demói ugyanezt a mintát követik: fehérje-kötő tervezésnél ~50%-os találati arány 12 célponton, egy 2–3 km felbontású Vénusz-domborzati térkép meglévő fotókból, illetve GPU-kernel optimalizáció akár 2,5x gyorsulással mélytanulási modelleken.
Árazás: az alapár marad, a cache lett olcsó
Fontos tisztázni, mi nem változott: a token alapára maradt input $10 / 1M token és output $50 / 1M token. A megtakarítás nem az alapárból, hanem a mellékköltségekből jön:
- Cache-olvasás: $0,25 / 1M token — a korábbi $1,00 helyett, vagyis 75%-os csökkentés. Ez a normál input ár mindössze 2,5%-a.
- Cache-írás: $12,50 / 1M token az 5 perces, $20 / 1M token az 1 órás változatnál.
- Batch feldolgozás: $5 input / $25 output 1M tokenenként — 50% kedvezmény.
Az Anthropic szerint egy tipikus munkaterhelésen ez ~25%-os, erősen ügynöki felhasználásnál akár 45%-os effektív költségcsökkenést hoz. A logika egyszerű: egy soklépéses ügynökfutás ugyanazt a hosszú kontextust olvassa újra és újra, tehát a számla nagy részét a cache-olvasás teszi ki.
Itt jön a gyengeség is, amit nem érdemes elhallgatni: az Opus 5 tokenenként továbbra is feleannyiba kerül ($5 input / $25 output). Ha a feladatod nem cache-nehéz, a Fable 5.1 továbbra is drágább marad — csak épp minden publikált benchmarkon jobb. Az Opus 5-ről szóló korábbi elemzésünkben részletesen bemutattuk, miért lett az a modell az ár-érték referencia; most az a referencia mozdult el.
Kevésbé korlátozó: mit jelent ez pontosan
A „kevésbé korlátozó” itt nem lazább etikát jelent, hanem kevesebb fals pozitívot. A kiberbiztonsági védőkorlátok 60%-kal ritkábban avatkoznak közbe Claude Code munkamenetenként, a biológiai védőkorlátok pedig 85%-kal ritkábban akadnak be jóhiszemű kérdéseknél — ez utóbbi kizárólag a Fable 5.1-re igaz, a Mythos 5.1-nél a beállítás változatlan.
Érdemi szabályváltozás, hogy a Fable 5.1 mostantól használható szoftveres sebezhetőségek azonosítására defenzív célból. A penetrációs tesztelés, az exploit-generálás és a bináris sebezhetőség-vizsgálat viszont továbbra is az Opus modellekhez van irányítva, szigorúbb sávban. A system card szerint a Mythos „alacsony kockázatú” automatizált AI-fejlesztésre alkalmas.
A viselkedésnél vegyes a kép. Az Anthropic saját mérése szerint az Opus 5-höz képest kis visszaesés van az igazodó viselkedésben, ugyanakkor a modell kevésbé hagyja figyelmen kívül a kifejezett megkötéseket, kevésbé hallucinál bemeneteket, és ritkábban állítja tévesen, hogy elvégzett egy feladatot. Ez utóbbi három hosszú ügynökfutásoknál sokkal többet ér, mint egy tizedpontnyi benchmark.
„It’s the strongest coding model we’ve used, but now it’s fast, token-efficient, and crucially actually speaks like a normal person.” — Dan Shipper, az Every vezérigazgatója
Aaron Levie, a Box vezérigazgatója arról számolt be, hogy a cég ügynöke Fable 5.1-gyel elkapta az adatok finom kétértelműségeit, amelyeket a Fable 5 még kihagyott.
Adatmegőrzés: Enterprise Frontier Safeguards
A vállalati oldal legnagyobb újdonsága nem modellképesség, hanem adatkezelés. Az Enterprise Frontier Safeguards (EFS) keretében a visszaélés-figyelő adat az ügyfél saját felhőjében marad — AWS, Azure vagy Google Cloud —, ügyfél által kezelt titkosítási kulcsokkal és audit-naplózással. Az Anthropic ezért nem számít fel külön díjat; a tárolás költségét az ügyfél állja.
A bevezetés 2026 őszén indul a Claude Code, a Claude Enterprise, a Claude Platform, az Amazon Bedrock, a Google Agent Platform és a Microsoft Foundry felületén. A TechCrunchnak nyilatkozva az Anthropic hangsúlyozta: „Anthropic has never trained on enterprise data without explicit permission.” A korlát ugyanakkor egyértelmű — ez ma még ígéret, nem élő funkció, tehát szabályozott iparágban a migrációt ehhez az ütemtervhez érdemes igazítani.
5 döntéshozói következtetés
- A cache-profilod dönti el, mennyit spórolsz. A 45%-os megtakarítás a hosszú kontextusú, soklépéses ügynökfutásokra vonatkozik. Rövid, egyszeri promptoknál az alapár nem változott — mérd meg a saját cache-olvasási arányodat, mielőtt költségcsökkenést tervezel be.
- Az Opus 5 nem került ki a képből. Tokenenként feleannyiba kerül, és offenzív kiberfeladatokra továbbra is az az engedélyezett sáv. Reális felállás a kettős modellstratégia, nem a teljes átállás.
- A megbízhatóság javulása fontosabb, mint a benchmark. Ha a modell ritkábban hallucinál bemenetet és ritkábban jelent kész munkát tévesen, az közvetlenül csökkenti a felügyeleti költséget — pont ez teszi vállalhatóvá a 38 órás felügyelet nélküli futás típusú forgatókönyveket.
- Az EFS az ütemterv miatt számít. Pénzügyi és egészségügyi szereplőknél az adatmegőrzés volt a fő kifogás. A megoldás a nagy hyperscaler-platformokon érkezik, de csak ősszel — a beszerzési és compliance folyamatot most érdemes indítani.
- A versenyben nyílt az olló az ügynöki szegmensben. A Terminal-Bench-Science-en a GPT-5.6 Sol 22,4%-ához képest a Fable 5.1 52,6%-a nem árnyalatnyi különbség. Aki tudományos vagy CLI-ügynök munkafolyamatot épít, annak ezt a különbséget a saját feladatain is le kell mérnie.
Kinek érdemes váltania
Váltás mellett szól: ha ügynöki, hosszú kontextusú kódolási vagy kutatási munkafolyamatot futtatsz, ahol a cache-olvasás dominál; ha eddig a túl gyakori biztonsági megszakítások lassítottak; vagy ha defenzív sebezhetőség-keresést szeretnél modellel támogatni.
Váltás ellen szól: ha rövid, cache-szegény hívásokból áll a terhelésed — ott az Opus 5 feleannyiba kerül; ha a Mythos 5.1 képességeire lenne szükséged, de nem vagy átvilágított szervezet; vagy ha a döntésed az EFS-en múlik, ami még nem élesedett.
Összefoglaló
A Claude Fable 5.1 és Mythos 5.1 kiadása jól mutatja, merre tolódik a modellverseny: a nyers képesség helyett egyre inkább a futtatási költség, a megbízhatóság és az adatkezelés lett a döntési tényező. A cache-olvasás 75%-os árcsökkentése, a fals biztonsági riasztások 60–85%-os visszaszorítása és az ügyfél felhőjében maradó monitorozási adat mind ugyanabba az irányba mutat: az Anthropic a napi vállalati használat súrlódásait csiszolja, nem egy új generációt jelent be. A benchmark-előny mellé most először került olyan költségszerkezet is, amivel a hosszú ügynökfutások üzletileg is védhetők — a fenntartás pedig az marad, hogy tokenenként ez továbbra sem a legolcsóbb Claude.
Kapcsolódó elemzésünk: ChatGPT vs Claude vs Gemini: melyik a legjobb 2026-ban? — és a cég hátteréről: Anthropic IPO: 100 milliárd dollár és 2 billiós értékeltség. Iratkozz fel a hírlevelünkre, hogy ne maradj le a következő modellfrissítésről.