Hírek / AI Modellek / xAI Grok 4.5: új „Opus-class” frontier modell fele annyi pénzért

xAI Grok 4.5: új „Opus-class” frontier modell fele annyi pénzért

Az xAI Grok 4.5 az első olyan frontier modell, amelyet a Musk-birodalom kifejezetten kódolásra és autonóm ágensekre képzett ki — és Elon Musk szerint egyenesen „Opus-class”, vagyis a Claude Opus 4.7-tel egy súlycsoportban. A SpaceX (amely februárban magába olvasztotta az xAI-t) 2026. július 8-án, szerdán adta ki a modellt, csütörtökön pedig már nyilvánosan is elérhetővé tette. A hír igazi tétje azonban nem a képesség, hanem az ár: a Grok 4.5 nagyjából a versenytársak felébe kerül.

Ez a bejelentés több, mint egy szokásos verziófrissítés. Ez a Cursor kódoló startup 60 milliárd dolláros felvásárlásának első kézzelfogható terméke, és egyben teszt arra a vertikálisan integrált AI-birodalomra, amit Musk az elmúlt hónapokban épített. Nézzük, mit tud, hogyan teljesít a benchmarkokon, és miért rezegtetheti meg az Anthropicot és az OpenAI-t.

Mi az xAI Grok 4.5, és miért „Opus-class”?

A SpaceXAI a Grok 4.5-öt „igáslónak” (workhorse) jellemzi: olyan modell, amely kódolásra, app-építésre, irodai és adminisztratív munkára, kutatásra és írásra egyaránt alkalmas. A hangsúly a rutinszerű szellemi munkán van — azon, amit egy vállalat naponta ezerszer végeztet el egy AI-val.

Musk az X-en tette fel a lécet: „Based on strong positive feedback from customers in our beta test program, @SpaceXAI will make Grok 4.5 available to the public tomorrow. It is an Opus-class model, but faster, more token-efficient and lower cost.” Vagyis a modell a belső értékelés szerint nagyjából összemérhető a Claude Opus 4.7-tel, csak gyorsabb, token-hatékonyabb és olcsóbb.

„A belső értékelésünk szerint a Grok 4.5 nagyjából összemérhető az Opus 4.7-tel, de sokkal gyorsabb. A képesség, a nagyobb sebesség és az alacsonyabb költség kombinációja teszi versenyképessé. A valós hasznosságra optimalizálunk, nem a benchmarkokra.” — Elon Musk

Az „Opus-class” itt marketingfogalom, nem független minősítés — érdemes fenntartással kezelni. A számok viszont önmagukért beszélnek, ezért érdemes elválasztani a két dolgot: mit állít a gyártó, és mit mérnek a független elemzők.

Hogyan készült: a Cursor-adatok és a Colossus szerepe

A Grok 4.5 nem a semmiből jött. A képzési adatait a Cursor kódoló editor éles fejlesztői interakcióiból nyerték: azt tanulta meg a modell, hogyan írnak, szerkesztenek és debugolnak valódi mérnökök munka közben. Ez magyarázza a kódolásra hangolt fókuszt.

A SpaceX áprilisban szerzett jogot a Cursor 60 milliárd dolláros megvásárlására, majd júniusban, a Nasdaq-ra lépése után gyakorolta ezt a jogot. Az all-stock tranzakció a CNBC szerint kb. 3,4% hígulást jelentett a részvényeseknek, a SpaceX papírjai mégis 16%-ot emelkedtek a hírre.

A tréning a memphisi Colossus szuperszámítógépen zajlott, amely jelenleg kb. 200 000 Nvidia GPU-ból áll, és a tervek szerint egymillió GPU-ig skálázzák. A Cursor csapata korábban éppen a számítási kapacitás szűkössége miatt volt akadályozva — a felvásárlással ez a korlát megszűnt.

Hogyan teljesít benchmarkokon a Grok 4.5?

A gyártói ígéret mellett fontos a független mérés. Az Artificial Analysis GDPval-AA v2 indexén — amely a valós, ágensi tudásalapú munkát rangsorolja — a Grok 4.5 a 4. helyen végzett, 1543-as Elo pontszámmal, „csak a legfrissebb Anthropic Claude kiadások mögött”.

Ez árnyaltabb kép, mint az „Opus-class” címke: a modell nem a legjobb tisztán képességben, de a legjobbak közvetlen közelében van. A gyengeséget vállalni kell — a Claude továbbra is előrébb áll a rangsorban.

A döntő adat viszont a költség: a Grok 4.5-nél egy befejezett feladat átlagosan 0,49 dollárba került, ami az Artificial Analysis szerint „közel 90%-kal olcsóbb, mint a rangsorban előtte álló modellek”. Ezzel a modell a teljesítmény–költség Pareto-frontjára került, vagyis adott árszinten nincs nála jobb, adott képességszinten nincs nála olcsóbb.

Egy fejlesztői visszajelzés jól illusztrálja a gyakorlati élményt: Evan Bacon szerint a Grok 4.5 épített neki egy rakétakövető appot élő adatokkal és 3D földgömbbel — „szükségem lehet egy új benchmarkra ez után”.

Mennyibe kerül? Az árazás, ami alávág a riválisoknak

Itt dől el a hír. A Grok 4.5 ára 2 dollár / millió input token és 6 dollár / millió output token. A SpaceXAI szerint ráadásul feladatonként fele annyi tokent használ, mint a versenytársak, így a tényleges költségelőny még nagyobb, mint amit a token-ár mutat.

Grok 4.5: 2 / 6 dollár. Claude Opus 4.7: 5 / 25 dollár. OpenAI Sol (GPT 5.6): 5 / 30 dollár. OpenAI Luna (legolcsóbb): 1 / 6 dollár. (Millió input / output tokenre vetítve.)

A legfájdalmasabb összehasonlítás a Claude Opusszal adódik: az output tokenek ára a Grok esetében 6 dollár, a Claude Opus 4.7-nél 25 dollár — több mint négyszeres különbség ott, ahol az ágensi feladatok a legtöbb tokent égetik. A várhatóan július 9-én érkező OpenAI Sol (GPT 5.6) output ára 30 dollár, ami még nagyobb szakadékot nyit.

A legolcsóbb OpenAI-modell, a Luna ugyan olcsóbb inputot ad (1 dollár), de az outputban a Grok azonos áron (6 dollár) hoz jóval magasabb, frontier-közeli képességet. Az autonóm ágensek pedig aránytalanul sok output tokent generálnak — itt számít igazán a különbség.

Mit jelent ez a vállalatoknak?

A vállalati vásárló számára az ágensi feladatok tokenéhesek: egy komplex, több lépéses feladat könnyen elfogyaszthat több százezer tokent. Ha a feladatonkénti költség 90%-kal alacsonyabb, az nem árnyalatnyi különbség, hanem a havi AI-számla nagyságrendjét befolyásolja.

Ez a helyzet átértékelheti a beszállító-választást akkor is, ha a Grok tisztán képességben egy hajszállal a Claude mögött marad. Sok éles workflow-nál nem a benchmark-csúcs számít, hanem az, hogy adott költségkereten belül mennyi valódi munkát lehet elvégezni — és ebben a Grok most erős.

Óvatosságra int viszont a szolgáltatói kockázat. A Cursor-felhasználóknak eddig szabad választásuk volt a modellek között (Claude, GPT is elérhető volt). Ha a SpaceXAI a saját felületén korlátozza vagy kiemelten előnyben részesíti a Grokot, azzal elidegenítheti a meglévő felhasználókat.

Mit jelent ez a piacnak?

A Grok 4.5 az árversenyt viszi új szintre a frontier szegmensben. Eddig a legjobb modellek prémium árat kértek; most egy közel frontier-szintű modell jön a töredékéért. Ez nyomás alá helyezheti az Anthropic és az OpenAI árazását pontosan a legjövedelmezőbb, nagy volumenű ágensi felhasználásnál.

A háttérben komoly tőke áll. A SpaceX–xAI februári fúziója a kombinált céget 1,25 billió dollárra értékelte (1 billió SpaceX + 250 milliárd xAI), a júniusi IPO után a részvény 135 dollárról 200 dollár fölé emelkedett, így a SpaceX az egyik legértékesebb amerikai vállalattá vált. Ez a méret finanszírozni tudja az agresszív árazást.

Van azonban egy kényes szál. A Cursor kódolópiaci részesedése a Ramp adatai szerint 41%-ról (2025. június) 26%-ra (2026. május) esett vissza, miközben az Anthropic a piac felét uralja. A Grok éppen ezt a lecsúszó pozíciót hivatott megfordítani — de szabályozási aggályokat is felvethet az EU-ban és az Egyesült Királyságban, ha a saját ökoszisztémáját előnyben részesíti.

5 döntéshozói következtetés a Grok 4.5-ről

  1. Számold újra az ágensi költséget: ha sok, tokenéhes ágensi feladatot futtatsz, a Grok 4.5 90%-kal alacsonyabb feladatköltsége érdemi megtakarítást hozhat — mérd meg a saját workflow-don.
  2. Ne dőlj be az „Opus-class” címkének: a független Artificial Analysis a 4. helyre sorolta a Claude mögé — tisztán képességben van egy kis lemaradás, ezt a döntésbe be kell építeni.
  3. Diverzifikálj a szolgáltatók között: ha a Cursoron dolgozol, tartsd nyitva a Claude/GPT opciót is, mert a platformpreferencia idővel változhat.
  4. Használd ki az árversenyt tárgyaláskor: a Grok belépő ára erős alkupozíció a meglévő Anthropic vagy OpenAI szerződéseidnél.
  5. Figyeld a szabályozói kockázatot: a vertikálisan integrált modell (adat + számítás + felület egy kézben) EU/UK versenyjogi kérdéseket vethet fel, ami hosszabb távon befolyásolhatja az elérhetőséget.

Ha az árazás oldaláról közelítenél a modellválasztáshoz, érdemes szélesebb kontextusban is megnézni a mezőnyt: kapcsolódó elemzésünkben részletesen összevetjük a legolcsóbb, éles munkára is alkalmas modelleket — Legolcsóbb AI 2026: melyikkel lehet tényleg dolgozni?

A frontier verseny új frontja: nem a legjobb, hanem a legolcsóbb frontier

A Grok 4.5 üzenete nem az, hogy megverte a Claude-ot. Az üzenet az, hogy egy közel azonos szintű modellt nagyjából a felébe kerülő áron kínál — és ez a frontier verseny súlypontját a nyers képességről a képesség/ár arányra tolja el.

Ha ez a trend folytatódik, a következő 12 hónap nagy kérdése már nem az lesz, hogy „melyik a legokosabb modell”, hanem hogy „melyik ad adott költségen a legtöbb valódi munkát”. A SpaceXAI most éppen ezt a kérdést tette fel a piacnak — és a válaszát mindenki más árazásán fogjuk lemérni.

Kapcsolódó modell-összehasonlító elemzésünk: Claude Sonnet 5: 60%-kal olcsóbb kódoló AI-modell. A legfrissebb modellhírekért iratkozz fel az AI Hírek hírlevelére.

Vélemény, hozzászólás?

Az e-mail címet nem tesszük közzé. A kötelező mezőket * karakterrel jelöltük