Hírek / AI Modellek / Qwen3.8-Max: az Alibaba új nyílt modellje kihívja a GPT-5.6-ot és a Fable 5-öt
Qwen3.8-Max

Qwen3.8-Max: az Alibaba új nyílt modellje kihívja a GPT-5.6-ot és a Fable 5-öt

A Qwen3.8-Max az Alibaba új, nyílt súlyú frontier modellje, amelyet a gyártói benchmarkok szerint agentic computer-use terén felülmúlja az OpenAI GPT-5.6 Sol Max-ot, és megközelíti az Anthropic Fable 5-öt — mindezt töredékáron. A modellt 2026. augusztus 3-án jelentették be, és azonnal széles körben elérhetővé tették.

Ez nem csupán egy újabb kínai modellkiadás. A 2,4 billió paraméteres, multimodális MoE (mixture-of-experts) rendszer a legkonkrétabb jele annak, hogy a nyílt modellek versenye 2026 nyarán beérte a zárt frontier ligát. A cikkben végignézzük, mi új benne, hogyan teljesít a méréseken, mennyibe kerül — és hol sántít a marketing.

Mi új a Qwen3.8-Max modellben?

A Qwen3.8-Max a legutóbbi Qwen3.7-Max fölé pozicionált csúcsmodell. Architektúrája MoE, azaz keverék-szakértő felépítésű: a teljes 2,4 billió paraméterből egy adott kérésre csak nagyjából 95 milliárd aktiválódik. Ez adja a magas képességszintet anélkül, hogy minden lekérdezésnél a teljes modellt futtatná.

A kontextusablak akár 1 millió token — vagyis hosszú dokumentumokat, teljes kódbázisokat vagy több forrásból álló kutatási anyagot is egyben lát. A The Register szerint a modell feltehetően hibrid Transformer+Mamba architektúrát használ, ez azonban nem hivatalosan megerősített feltételezés, nem tény.

Érdemes tudni az előzményt: az Alibaba a modellt már egy hónappal korábban „preview” formában megmutatta, akkor még óvatosabb, „csak a Fable 5 mögött második” állítással. A mostani kiadás ehhez képest merészebb pozíciót foglal el.

Nyílt súlyok — de egyelőre ismeretlen licenccel

A legnagyobb húzás, hogy az Alibaba jövő héten nyílt súlyokként is kiadja a modellt a Hugging Face-en, egy kisebb, Qwen3.8-27B testvérmodellel együtt. Ez visszatérés a cég nyílt stratégiájához, miután idén rövid ideig a zárt kiadások felé fordultak a fejlettebb modellekkel.

Egy fontos fenntartás: a súlyok pontos licence még nem ismert. Lehet megengedő (mint egy Apache 2.0), de lehet korlátozóbb egyedi licenc is — ahogy a Moonshot Kimi K3 esetében kereskedelmi „Model as a Service” feltétel kötötte a használatot. A vállalati felhasználóknak érdemes megvárni a licenc szövegét, mielőtt önhosztolásba fognak.

Hogyan teljesít a Qwen3.8-Max a benchmarkokon?

A gyártói számok látványosak. A computer-use-t mérő OSWorld-Verified teszten a Qwen3.8-Max 86,1 pontot ért el, megelőzve a GPT-5.6 Sol Max 83,2-es és a Fable 5 85,0-es eredményét — a Gemini 3.1 Pro 76,2 pontja pedig messze lemaradt.

A kutatás-reprodukciót mérő PaperBench teszten 93,0 ponttal a mezőny legmagasabb közölt eredményét jegyzi. További Alibaba-adatok: TerminalBench 2.1 86,6, Vision2Web 69,0, LVBench 81,8 és ERQA 77,8.

A cég a gyengeségeket is elismeri: a SWE-Pro szoftverfejlesztési benchmarkon az OpenAI modellje a legjobb, az „Agents’ Last Exam” és bizonyos kódolási tesztek terén pedig a Claude Opus 4.8 vezet. A Qwen3.8-Max tehát nem mindenben első.

A független mérések szerényebb képet festenek

Itt jön a lényeg, amit a marketing elhallgat. A független Artificial Analysis Intelligence ranglista szerint a Qwen3.8-Max nagyjából a Claude Sonnet 5 szintjén áll — vagyis jóval szerényebben, mint a „Fable 5-höz közeli” pozíció, amit az Alibaba sugall.

A Nikkei Asia kritikus elemzése szerint a modell elmarad a „csak a Fable 5 mögött második” állítástól: több hazai és nemzetközi versenytárs is megelőzi. A The Verge által idézett Arena.ai ranglistán a szöveges modellek között a Qwen3.8-Max a Fable 5 és három Claude Opus modell mögött végez, frontend kódolásban pedig két Claude Opus és a Kimi K3 is megelőzi.

A tanulság egyszerű: a gyártói OSWorld 86,1 és PaperBench 93,0 lenyűgöző, de a független Artificial Analysis és a Nikkei szerint a valóság szerényebb — a Qwen3.8-Max inkább a Claude Sonnet 5, nem az Opus vagy a Fable 5 ligájában játszik.

Korábban mi is részletesen elemeztük az elődöt, amely a Code Arena top 5-be került: Qwen3.7-Max az Alibaba kódoló modellje. A 3.8-as verzió ehhez képest jelentős, de nem mindenben egyértelmű lépés előre.

Mennyibe kerül a Qwen3.8-Max?

Az ár a modell legerősebb érve. A QwenCloud API-n a Qwen3.8-Max 2 dollár / millió input token és 6 dollár / millió output token — összesen 8 dollár / millió token. Ez kevesebb mint a Claude Opus 5 árának harmada, és kevesebb mint a GPT-5.6 Sol Max árának negyede.

Ártérkép (összesen / millió token): DeepSeek V4-Flash 0,42 $ → GPT-5.6 Luna 1,40 $ → Qwen3.8-Max 8,00 $ → Kimi K3 18,00 $ → Claude Opus 5 30,00 $ → GPT-5.6 Sol 35,00 $ → Claude Fable 5 / Mythos 5 60,00 $.

A The Register közvetlen összevetése különösen érdekes a magyar fejlesztőknek: a hasonló képességű Claude Sonnet 5 ára 2 dollár input + 10 dollár output, és ez az ár 2026. szeptember 1-től 50%-kal emelkedik. A Qwen3.8-Max így ár-érték arányban komoly nyomást helyez a nyugati kínálatra.

A prompt-gyorsítótárazás is olcsó: 0,25 dollár / millió implicit cache, 0,17 dollár / millió explicit cache olvasás és 2,5 dollár / millió explicit cache írás. Önhosztoláshoz a Register szerint 48–64 Nvidia B200-osztályú GPU kell ügyfélszolgálati telepítéshez, illetve 8–16 B300 vagy AMD MI355X belső munkafolyamatokhoz — vagyis a súlyok szabadok, de a futtatás nem olcsó.

A demók lenyűgözőek — de senki nem reprodukálta őket

Az Alibaba több figyelemre méltó képességet is felmutatott. A leghangzatosabb: a modell állítólag 16 nap alatt, emberi beavatkozás nélkül épített és finomított egy teljes AI kódolóeszközt — kódolással, teszteléssel, hibajavítással együtt.

További állítások: 10+ napos önálló szoftverprojektek befejezése, több ezer soros kutatási kód reprodukálása, iteratív chip-tervezési optimalizáció és multimodális visszacsatolásos tervfrissítés. Mindez rendkívül erős — ha igaz.

Itt a legfontosabb fenntartás: ezek kizárólag gyártói demonstrációk, amelyeket független fél még nem reprodukált. A VentureBeat, a Forbes és a The Register is külön kiemeli, hogy ezeket az eredményeket óvatosan kell kezelni, amíg nincs semleges megerősítés.

Kinek érdemes váltania a Qwen3.8-Max modellre?

A modell nem mindenkinek kötelező, de három csoportnak kifejezetten megéri kipróbálnia. Az első a költségérzékeny agentic use case: aki nagy tömegben futtat computer-use vagy hosszú kontextusú feladatokat, annál a 8 dolláros token-ár drámai különbséget hozhat a havi számlán.

A második az önhosztolást és adatkontrollt igénylő vállalat. A nyílt súlyok elvben lehetővé teszik a saját infrastruktúrán futtatást és a finomhangolást — feltéve, hogy a jövő héten érkező licenc ezt engedi. Aki érzékeny adatokkal dolgozik, ennek a lehetőségnek stratégiai értéke van.

A harmadik csoport a modellportfóliót építő fejlesztő, aki nem egyetlen szolgáltatóra akar hagyatkozni. A Qwen3.8-Max jó „második vélemény” modell lehet a nyugati zártak mellett, különösen a szeptemberi Claude Sonnet 5 áremelés fényében. Aki viszont tiszta, nehéz szoftverfejlesztési feladatra keres csúcseszközt, annak egyelőre az OpenAI és a Claude Opus 4.8 marad az erősebb választás.

Mit jelent ez a piacnak?

A Qwen3.8-Max nem elszigetelt esemény, hanem egy összehangoltnak tűnő kínai nyílt modell offenzíva része. Ugyanezen a héten érkezett a Moonshot Kimi K3 (2,8 billió paraméter) és a DeepSeek V4-Flash-0731 is, a ByteDance és a MiniMax pedig új videógeneráló modelleket adott ki.

A kontraszt éles: az amerikai oldal legjobb nyílt súlyú modellje, az „Inkling” mindössze néhány milliárd paraméteres, és jelentősen elmarad a kínai kínálattól. A nyugati élmezőny a zárt frontier modellekre koncentrál, a nyílt terepet pedig egyre inkább Kína uralja.

A kísérőmodellek is beszédesek. A DeepSeek V4-Flash-0731 mindössze 284 milliárd paraméteres, elfér 142 GB GPU-memóriában, és független mérés szerint csak 1 ponttal marad el a GPT-5.6 Lunától — miközben feladatonként 40%-kal olcsóbb (0,03 vs 0,05 dollár cost-to-solve). Ez azt üzeni, hogy a kínai kínálat nemcsak a csúcson, hanem a hatékony középkategóriában is nyom.

Clément Delangue, a Hugging Face vezérigazgatója a CNBC-nek: „Egyértelműen dominálnak a nyílt modelleknél, és nem lepődnék meg, ha a fejlődés jelenlegi ütemével az év végére vagy jövőre a frontieren is dominálni kezdenének.”

A piaci reakció is beszédes: az Alibaba részvénye a bejelentés napján 4,8%-kal emelkedett, egy korábbi 7%-os hongkongi kereskedési ugrás után. A vállalati oldalon pedig a proxymodellek biztonsági aggályai — például az AI-ügynökök általi kibertámadások — miatt egyre több cég fontolgathatja a kínai nyílt modellekre váltást, ahol a finomhangolás, az önhosztolás és az adatkontroll versenyelőnyt adhat.

Nem mindenki lelkes. Dario Amodei, az Anthropic vezérigazgatója korábban jelezte: nem a nyílt modellek ellen van általában, hanem konkrétan a kínai eredetűek, a zárt modellekből desztilláltak és a szigorú biztonsági metrikáknak meg nem felelők ellen — ami a The Register olvasatában gyakorlatilag lefedi mindazt, ami valóban versenyez az Anthropic modelljeivel.

5 döntéshozói következtetés a Qwen3.8-Max kapcsán

  1. Költség-előny valós, de mérd újra. A 8 dollár / millió token ár tört része a nyugati csúcsmodelleknek. Ha a use case computer-use vagy hosszú kontextus, a Qwen3.8-Max komoly megtakarítást hozhat — de saját feladatokon tesztelj, ne a gyártói benchmarkra hagyatkozz.
  2. A független ranglista a mérvadó. Vásárlási döntésnél az Artificial Analysis szerinti Claude Sonnet 5 szintet vedd alapul, ne a Fable 5-höz hasonlító marketinget.
  3. Szoftverfejlesztéshez maradj óvatos. A SWE-Pro és az „Agents’ Last Exam” terén az OpenAI és a Claude Opus 4.8 vezet — tiszta kódolási workflow-hoz ezek még erősebbek lehetnek.
  4. Várd meg a licencet. Az önhosztolást tervező cégeknek a súlyok kiadása önmagában nem elég: a licenc feltételei döntik el, hogy kereskedelmi célra egyáltalán használható-e.
  5. Készülj a Sonnet 5 áremelésre. A szeptember 1-i 50%-os Claude Sonnet 5 áremelés önmagában is indokolttá teheti, hogy legalább kísérleti szinten bevond a Qwen3.8-Max-ot a modellportfólióba.

A nyílt modellek versenye most dőlt el — Kína javára

A Qwen3.8-Max nem attól fontos, hogy minden benchmarkot megnyer — nem nyer meg mindent. Attól fontos, hogy egy nyílt súlyú, önhosztolható modell most először kényszeríti védekezésbe a zárt frontier árazását, méghozzá a Claude Sonnet 5 szintjén, annak töredékáráért.

A kérdés 2026 második felére már nem az, hogy a kínai nyílt modellek utolérik-e a nyugati zárt kínálatot, hanem az, hogy a nyugati cégek meddig tudják tartani az árprémiumot, ha a képességkülönbség tovább zsugorodik. A választ nagyrészt az fogja eldönteni, milyen licenccel érkeznek meg jövő héten a Qwen3.8-Max súlyai.

A teljes ártérkép és a valóban használható olcsó modellek összevetéséhez olvasd el kapcsolódó elemzésünket: Legjobb olcsó AI modellek 2026: DeepSeek, Qwen, Gemini Flash és GLM árakkal. Iratkozz fel hírlevelünkre is, hogy ne maradj le a következő modellkiadásokról. Forrás: VentureBeat.

Egy válasz

Vélemény, hozzászólás?

Az e-mail címet nem tesszük közzé. A kötelező mezőket * karakterrel jelöltük