A Qwen3.8-Max az Alibaba új, nyílt súlyú frontier modellje, amelyet a gyártói benchmarkok szerint agentic computer-use terén felülmúlja az OpenAI GPT-5.6 Sol Max-ot, és megközelíti az Anthropic Fable 5-öt — mindezt töredékáron. A modellt 2026. augusztus 3-án jelentették be, és azonnal széles körben elérhetővé tették.
Ez nem csupán egy újabb kínai modellkiadás. A 2,4 billió paraméteres, multimodális MoE (mixture-of-experts) rendszer a legkonkrétabb jele annak, hogy a nyílt modellek versenye 2026 nyarán beérte a zárt frontier ligát. A cikkben végignézzük, mi új benne, hogyan teljesít a méréseken, mennyibe kerül — és hol sántít a marketing.
Mi új a Qwen3.8-Max modellben?
A Qwen3.8-Max a legutóbbi Qwen3.7-Max fölé pozicionált csúcsmodell. Architektúrája MoE, azaz keverék-szakértő felépítésű: a teljes 2,4 billió paraméterből egy adott kérésre csak nagyjából 95 milliárd aktiválódik. Ez adja a magas képességszintet anélkül, hogy minden lekérdezésnél a teljes modellt futtatná.
A kontextusablak akár 1 millió token — vagyis hosszú dokumentumokat, teljes kódbázisokat vagy több forrásból álló kutatási anyagot is egyben lát. A The Register szerint a modell feltehetően hibrid Transformer+Mamba architektúrát használ, ez azonban nem hivatalosan megerősített feltételezés, nem tény.
Érdemes tudni az előzményt: az Alibaba a modellt már egy hónappal korábban „preview” formában megmutatta, akkor még óvatosabb, „csak a Fable 5 mögött második” állítással. A mostani kiadás ehhez képest merészebb pozíciót foglal el.
Nyílt súlyok — de egyelőre ismeretlen licenccel
A legnagyobb húzás, hogy az Alibaba jövő héten nyílt súlyokként is kiadja a modellt a Hugging Face-en, egy kisebb, Qwen3.8-27B testvérmodellel együtt. Ez visszatérés a cég nyílt stratégiájához, miután idén rövid ideig a zárt kiadások felé fordultak a fejlettebb modellekkel.
Egy fontos fenntartás: a súlyok pontos licence még nem ismert. Lehet megengedő (mint egy Apache 2.0), de lehet korlátozóbb egyedi licenc is — ahogy a Moonshot Kimi K3 esetében kereskedelmi „Model as a Service” feltétel kötötte a használatot. A vállalati felhasználóknak érdemes megvárni a licenc szövegét, mielőtt önhosztolásba fognak.
Hogyan teljesít a Qwen3.8-Max a benchmarkokon?
A gyártói számok látványosak. A computer-use-t mérő OSWorld-Verified teszten a Qwen3.8-Max 86,1 pontot ért el, megelőzve a GPT-5.6 Sol Max 83,2-es és a Fable 5 85,0-es eredményét — a Gemini 3.1 Pro 76,2 pontja pedig messze lemaradt.
A kutatás-reprodukciót mérő PaperBench teszten 93,0 ponttal a mezőny legmagasabb közölt eredményét jegyzi. További Alibaba-adatok: TerminalBench 2.1 86,6, Vision2Web 69,0, LVBench 81,8 és ERQA 77,8.
A cég a gyengeségeket is elismeri: a SWE-Pro szoftverfejlesztési benchmarkon az OpenAI modellje a legjobb, az „Agents’ Last Exam” és bizonyos kódolási tesztek terén pedig a Claude Opus 4.8 vezet. A Qwen3.8-Max tehát nem mindenben első.
A független mérések szerényebb képet festenek
Itt jön a lényeg, amit a marketing elhallgat. A független Artificial Analysis Intelligence ranglista szerint a Qwen3.8-Max nagyjából a Claude Sonnet 5 szintjén áll — vagyis jóval szerényebben, mint a „Fable 5-höz közeli” pozíció, amit az Alibaba sugall.
A Nikkei Asia kritikus elemzése szerint a modell elmarad a „csak a Fable 5 mögött második” állítástól: több hazai és nemzetközi versenytárs is megelőzi. A The Verge által idézett Arena.ai ranglistán a szöveges modellek között a Qwen3.8-Max a Fable 5 és három Claude Opus modell mögött végez, frontend kódolásban pedig két Claude Opus és a Kimi K3 is megelőzi.
A tanulság egyszerű: a gyártói OSWorld 86,1 és PaperBench 93,0 lenyűgöző, de a független Artificial Analysis és a Nikkei szerint a valóság szerényebb — a Qwen3.8-Max inkább a Claude Sonnet 5, nem az Opus vagy a Fable 5 ligájában játszik.
Korábban mi is részletesen elemeztük az elődöt, amely a Code Arena top 5-be került: Qwen3.7-Max az Alibaba kódoló modellje. A 3.8-as verzió ehhez képest jelentős, de nem mindenben egyértelmű lépés előre.
Mennyibe kerül a Qwen3.8-Max?
Az ár a modell legerősebb érve. A QwenCloud API-n a Qwen3.8-Max 2 dollár / millió input token és 6 dollár / millió output token — összesen 8 dollár / millió token. Ez kevesebb mint a Claude Opus 5 árának harmada, és kevesebb mint a GPT-5.6 Sol Max árának negyede.
Ártérkép (összesen / millió token): DeepSeek V4-Flash 0,42 $ → GPT-5.6 Luna 1,40 $ → Qwen3.8-Max 8,00 $ → Kimi K3 18,00 $ → Claude Opus 5 30,00 $ → GPT-5.6 Sol 35,00 $ → Claude Fable 5 / Mythos 5 60,00 $.
A The Register közvetlen összevetése különösen érdekes a magyar fejlesztőknek: a hasonló képességű Claude Sonnet 5 ára 2 dollár input + 10 dollár output, és ez az ár 2026. szeptember 1-től 50%-kal emelkedik. A Qwen3.8-Max így ár-érték arányban komoly nyomást helyez a nyugati kínálatra.
A prompt-gyorsítótárazás is olcsó: 0,25 dollár / millió implicit cache, 0,17 dollár / millió explicit cache olvasás és 2,5 dollár / millió explicit cache írás. Önhosztoláshoz a Register szerint 48–64 Nvidia B200-osztályú GPU kell ügyfélszolgálati telepítéshez, illetve 8–16 B300 vagy AMD MI355X belső munkafolyamatokhoz — vagyis a súlyok szabadok, de a futtatás nem olcsó.
A demók lenyűgözőek — de senki nem reprodukálta őket
Az Alibaba több figyelemre méltó képességet is felmutatott. A leghangzatosabb: a modell állítólag 16 nap alatt, emberi beavatkozás nélkül épített és finomított egy teljes AI kódolóeszközt — kódolással, teszteléssel, hibajavítással együtt.
További állítások: 10+ napos önálló szoftverprojektek befejezése, több ezer soros kutatási kód reprodukálása, iteratív chip-tervezési optimalizáció és multimodális visszacsatolásos tervfrissítés. Mindez rendkívül erős — ha igaz.
Itt a legfontosabb fenntartás: ezek kizárólag gyártói demonstrációk, amelyeket független fél még nem reprodukált. A VentureBeat, a Forbes és a The Register is külön kiemeli, hogy ezeket az eredményeket óvatosan kell kezelni, amíg nincs semleges megerősítés.
Kinek érdemes váltania a Qwen3.8-Max modellre?
A modell nem mindenkinek kötelező, de három csoportnak kifejezetten megéri kipróbálnia. Az első a költségérzékeny agentic use case: aki nagy tömegben futtat computer-use vagy hosszú kontextusú feladatokat, annál a 8 dolláros token-ár drámai különbséget hozhat a havi számlán.
A második az önhosztolást és adatkontrollt igénylő vállalat. A nyílt súlyok elvben lehetővé teszik a saját infrastruktúrán futtatást és a finomhangolást — feltéve, hogy a jövő héten érkező licenc ezt engedi. Aki érzékeny adatokkal dolgozik, ennek a lehetőségnek stratégiai értéke van.
A harmadik csoport a modellportfóliót építő fejlesztő, aki nem egyetlen szolgáltatóra akar hagyatkozni. A Qwen3.8-Max jó „második vélemény” modell lehet a nyugati zártak mellett, különösen a szeptemberi Claude Sonnet 5 áremelés fényében. Aki viszont tiszta, nehéz szoftverfejlesztési feladatra keres csúcseszközt, annak egyelőre az OpenAI és a Claude Opus 4.8 marad az erősebb választás.
Mit jelent ez a piacnak?
A Qwen3.8-Max nem elszigetelt esemény, hanem egy összehangoltnak tűnő kínai nyílt modell offenzíva része. Ugyanezen a héten érkezett a Moonshot Kimi K3 (2,8 billió paraméter) és a DeepSeek V4-Flash-0731 is, a ByteDance és a MiniMax pedig új videógeneráló modelleket adott ki.
A kontraszt éles: az amerikai oldal legjobb nyílt súlyú modellje, az „Inkling” mindössze néhány milliárd paraméteres, és jelentősen elmarad a kínai kínálattól. A nyugati élmezőny a zárt frontier modellekre koncentrál, a nyílt terepet pedig egyre inkább Kína uralja.
A kísérőmodellek is beszédesek. A DeepSeek V4-Flash-0731 mindössze 284 milliárd paraméteres, elfér 142 GB GPU-memóriában, és független mérés szerint csak 1 ponttal marad el a GPT-5.6 Lunától — miközben feladatonként 40%-kal olcsóbb (0,03 vs 0,05 dollár cost-to-solve). Ez azt üzeni, hogy a kínai kínálat nemcsak a csúcson, hanem a hatékony középkategóriában is nyom.
Clément Delangue, a Hugging Face vezérigazgatója a CNBC-nek: „Egyértelműen dominálnak a nyílt modelleknél, és nem lepődnék meg, ha a fejlődés jelenlegi ütemével az év végére vagy jövőre a frontieren is dominálni kezdenének.”
A piaci reakció is beszédes: az Alibaba részvénye a bejelentés napján 4,8%-kal emelkedett, egy korábbi 7%-os hongkongi kereskedési ugrás után. A vállalati oldalon pedig a proxymodellek biztonsági aggályai — például az AI-ügynökök általi kibertámadások — miatt egyre több cég fontolgathatja a kínai nyílt modellekre váltást, ahol a finomhangolás, az önhosztolás és az adatkontroll versenyelőnyt adhat.
Nem mindenki lelkes. Dario Amodei, az Anthropic vezérigazgatója korábban jelezte: nem a nyílt modellek ellen van általában, hanem konkrétan a kínai eredetűek, a zárt modellekből desztilláltak és a szigorú biztonsági metrikáknak meg nem felelők ellen — ami a The Register olvasatában gyakorlatilag lefedi mindazt, ami valóban versenyez az Anthropic modelljeivel.
5 döntéshozói következtetés a Qwen3.8-Max kapcsán
- Költség-előny valós, de mérd újra. A 8 dollár / millió token ár tört része a nyugati csúcsmodelleknek. Ha a use case computer-use vagy hosszú kontextus, a Qwen3.8-Max komoly megtakarítást hozhat — de saját feladatokon tesztelj, ne a gyártói benchmarkra hagyatkozz.
- A független ranglista a mérvadó. Vásárlási döntésnél az Artificial Analysis szerinti Claude Sonnet 5 szintet vedd alapul, ne a Fable 5-höz hasonlító marketinget.
- Szoftverfejlesztéshez maradj óvatos. A SWE-Pro és az „Agents’ Last Exam” terén az OpenAI és a Claude Opus 4.8 vezet — tiszta kódolási workflow-hoz ezek még erősebbek lehetnek.
- Várd meg a licencet. Az önhosztolást tervező cégeknek a súlyok kiadása önmagában nem elég: a licenc feltételei döntik el, hogy kereskedelmi célra egyáltalán használható-e.
- Készülj a Sonnet 5 áremelésre. A szeptember 1-i 50%-os Claude Sonnet 5 áremelés önmagában is indokolttá teheti, hogy legalább kísérleti szinten bevond a Qwen3.8-Max-ot a modellportfólióba.
A nyílt modellek versenye most dőlt el — Kína javára
A Qwen3.8-Max nem attól fontos, hogy minden benchmarkot megnyer — nem nyer meg mindent. Attól fontos, hogy egy nyílt súlyú, önhosztolható modell most először kényszeríti védekezésbe a zárt frontier árazását, méghozzá a Claude Sonnet 5 szintjén, annak töredékáráért.
A kérdés 2026 második felére már nem az, hogy a kínai nyílt modellek utolérik-e a nyugati zárt kínálatot, hanem az, hogy a nyugati cégek meddig tudják tartani az árprémiumot, ha a képességkülönbség tovább zsugorodik. A választ nagyrészt az fogja eldönteni, milyen licenccel érkeznek meg jövő héten a Qwen3.8-Max súlyai.
A teljes ártérkép és a valóban használható olcsó modellek összevetéséhez olvasd el kapcsolódó elemzésünket: Legjobb olcsó AI modellek 2026: DeepSeek, Qwen, Gemini Flash és GLM árakkal. Iratkozz fel hírlevelünkre is, hogy ne maradj le a következő modellkiadásokról. Forrás: VentureBeat.
Egy válasz