GPT-5.6 Sol API: az OpenAI 20 százaléknál nagyobb mértékben csökkentette a fejlesztői árazást: a zászlóshajó modell API-ja és kredit-alapú használata 2026. augusztus 22-től három hónapon át olcsóbb. A bejelentés augusztus 21-én érkezett, és a cég maga is nyíltan a versenyhelyzetre hivatkozik — az Anthropic és a kínai modellek nyomására.
Ez már a harmadik árazási lépés a GPT-5.6 családnál július vége óta. Ha bármilyen API-alapú munkafolyamatot üzemeltetsz, a mostani vágás közvetlenül a havi számládon fog látszani — de csak egy pontosan behatárolt ideig.
GPT-5.6 Sol API: számok és tények
A GPT-5.6 Sol új, standard (rövid kontextusú) árazása 1 millió tokenre vetítve:
- Input: 4 dollár — korábban 5 dollár (-20%)
- Output: 20 dollár — korábban 30 dollár (-33%)
A kedvezmény 2026. augusztus 22-től három hónapig él, és nem csak a nyers API-ra vonatkozik: kiterjed a ChatGPT Work és a Codex kredit-alapú csomagjaira is. Fontos a másik oldal: a Pro, a Plus és a Business előfizetések díja változatlan marad — a vágás kizárólag a használat-alapú és kredit-alapú árazást érinti.
„Az OpenAI a következő három hónapra 20 százaléknál nagyobb mértékben csökkentette a GPT-5.6 Sol API- és kredit-árazását.” — OpenAI hivatalos közlemény, 2026. augusztus 21.
A lépés egy sorozat harmadik eleme. A 2026. július 30-i körben a GPT-5.6 Terra ára 20 százalékkal csökkent (2,50 → 2,00 dollár input, 15 → 12 dollár output), a GPT-5.6 Luna pedig 80 százalékkal lett olcsóbb (1,00 → 0,20 dollár input, 6,00 → 1,20 dollár output). A család 2026. július 9-i indulásakor a listaárak még így néztek ki: Sol 5/30, Terra 2,50/15, Luna 1/6 dollár millió tokenenként.
Honnan jön a mozgástér?
Az OpenAI a Luna-vágásnál konkrét technikai indoklást adott, és ez a mostani lépés hátterét is magyarázza. A Sol modell saját magát használva írta át a produkciós GPU-inferencia kerneleket Tritonban és Gluonban — ezek azok az alacsony szintű programrészek, amelyek a modell futtatását végzik a grafikus processzorokon. Az eredmény: 20 százalékkal alacsonyabb végponttól végpontig tartó kiszolgálási költség és 15 százalékkal jobb token-generálási hatékonyság, elsősorban a spekulatív dekódolásnál használt draft-modell jobb teljesítménye miatt.
Vagyis nem pusztán marketingárazásról van szó: a kiszolgálási költség tényleges csökkenése egy részét fedezi a vágásnak. Ez viszont nem jelenti azt, hogy az új árszint automatikusan tartós.
A csomag másik fele egy prémium irány. Az új „Sol Fast” mód — a korábbi Priority Processing utódja — akár 2,5-szeres sebességet ígér a standard feldolgozáshoz képest, de 1 millió tokenenként 70 dolláros kombinált (input + output) áron, szemben a vágás előtti, körülbelül 35 dolláros standard Sol szinttel. Az OpenAI tehát egyszerre nyomja lefelé a belépő árat és épít fel egy magasabb árszintű sávot a sebességre fizetőknek.
Mit jelent ez a piacnak?
A versenytárs-árakat a Reuters is kiemelte, és ezek teszik értelmezhetővé a lépést. 1 millió tokenre vetítve: az Anthropic Claude Fable 5 10 dollár input / 50 dollár output, a Claude Opus 5 5 dollár input / 25 dollár output. A vágás után a Sol mindkettő alá árazza magát — az Opus 5-höz képest is nagyjából 20 százalékkal olcsóbb inputon és outputon egyaránt.
Az időzítés sem véletlen. A júliusi Luna-vágás néhány nappal azután jött, hogy az Anthropic kiadta a Claude Opus 5-öt (az Opus 4.8-cal azonos áron), a Google pedig bemutatta a Gemini 3.6 Flash és 3.5 Flash-Lite modelleket. A mostani lépés pedig egybeesik az Anthropic IPO-előkészületeivel — vagyis az OpenAI éppen akkor mozdítja meg a piaci árat, amikor a fő riválisa a tőkepiacok előtt méreti meg magát.
Teljesítményoldalról a Sol pozíciója erős: a modell az Agents’ Last Exam benchmarkon 53,6 pontot ért el, 13,1 ponttal megelőzve a Claude Fable 5-öt, az Artificial Analysis Coding Agent Indexen pedig 80 pontos csúcsot állított fel. Az ár/teljesítmény arány tehát nem gyenge modell leértékeléséből jön.
Magyar piaci vonatkozás
Magyar fejlesztőcsapatoknak, ügynökségeknek és belső automatizálást építő cégeknek ez a lépés dollárban közvetlenül mérhető: aki nagy volumenű, Sol-alapú API-integrációt futtat — kódgenerálást, dokumentumfeldolgozást vagy hosszan futó ügynöki munkafolyamatokat —, annak a token-számlája a következő három hónapban érdemben csökken. A hatás a tokenigényes agentikus feladatoknál a legnagyobb, ahol egyetlen futás is több százezer tokent éget el.
Két gyakorlati megfontolás. Az egyik, hogy az előfizetéses díjak nem változnak — akinek a csapata ChatGPT Plus vagy Business licenceken dolgozik, annál ebből semmi nem látszik. A másik, hogy a kedvezmény határidős: érdemes már most kiszámolni, mi lesz a futó projektek költségével a visszaállás után, és nem a kedvezményes árra tervezni egy éves büdzsét.
Ez a cikk tényközlés és piaci elemzés, nem befektetési ajánlás.
Kitekintés
A három hónapos időkorlát a legárulkodóbb részlet. Egy tartós árstratégia-váltás nem szokott lejárati dátummal érkezni — ez inkább taktikai lépés, amelynek célja piaci részesedés szerzése a fejlesztők között, miközben a legnagyobb rivális figyelme a tőzsdei bevezetésén van. A kedvezmény 2026 november vége körül jár le, és az igazi kérdés az, mi történik utána: visszaáll a régi árszint, tartósan bent marad az új, vagy időközben egy újabb versenylépés írja felül az egészet.
Addig is érdemes a saját számaidat nézni: mérd meg, mennyibe kerül most egy tipikus futásod, és tedd el az adatot. Az AI-modellek árazása 2026-ban néhány hetente mozdul — a döntést csak friss költségadatra érdemes alapozni.
Kapcsolódó piaci elemzésünk: AI kódoló ágensek költsége: 5 lépés a token-számlák ellen — gyakorlati módszerek arra, hogy a kedvezmény lejárta után is kordában tartsd a kiadásokat. A versenytárs oldaláról pedig itt írtunk: Claude Opus 5: az Anthropic új csúcsmodellje feleáron, Fable 5 tudással.
Maradj képben: iratkozz fel az AI Hírek heti összefoglalójára, hogy péntek reggel megkapd a legfontosabb AI-híreket és egy használható promptot.