Hírek / AI Összefoglaló / Anthropic lassítási terv: Amodei fékezné az AI-t — heti AI összefoglaló
Anthropic lassítási terv

Anthropic lassítási terv: Amodei fékezné az AI-t — heti AI összefoglaló

Az Anthropic lassítási terv három lépésben fékezné az AI-fejlesztés tempóját: Dario Amodei, az Anthropic vezérigazgatója szeptember 12-én egy hosszú esszében tette le a javaslatot — és a cég az első lépést egyoldalúan, azonnal bevezeti. A „pace the frontier” (fékezzük a frontvonalat) javaslat a hét legfontosabb AI-híre, mert nem elvi vitáról szól: külső, független értékelők kapnak belső hozzáférést az Anthropic kockázatértékelési munkájához.

A felvetés időzítése nem véletlen. Ugyanezen a héten jelent meg az Anthropic saját fenyegetés-jelentése, amely öt konkrét esetet mutat be arra, hogyan használták a Claude-ot háborús célzásra, rakétafejlesztésre és tömeges megfigyelésre. Az OpenAI eközben bejelentette, hogy 2026-ban biztosan nem megy tőzsdére — szintén biztonsági aggályokra hivatkozva. Íme a hét öt legfontosabb fejleménye, egy kiemelt számmal és egy gyakorlati tippel a végén.

Anthropic lassítási terv: három lépés leállítás nélkül

Az esszé („We must pace the frontier”) központi tétele egyetlen mondatban összefoglalható, és Amodei maga fogalmazza meg:

„Lassítanunk kell azt a tempót, amellyel az AI-modellek képességeit fejlesztjük. A haladás így is gyorsnak fog tűnni.” — Dario Amodei, Anthropic

Vagyis nem a fejlesztés leállításáról van szó, hanem arról, hogy a képességnövekedés ütemét a biztonsági intézkedések tempójához kell igazítani. A terv három lépésből áll:

  1. Beágyazott külső értékelők. Független harmadik fél — például a METR — szakértői kapnának állandó belső hozzáférést az AI-cégek kockázatértékelési csapataihoz, a belső csapatokéhoz hasonló szintű betekintéssel. A TechCrunch szerint ez az a pont, amit az Anthropic „unilaterally committing to”, azaz egyoldalúan vállal — és Amodei állítása szerint az OpenAI is követni fogja.
  2. Közös iparági biztonsági standardok. A vezető AI-cégek koordinálnák a biztonsági normákat és a fejlesztés ütemét. Amodei szerint ehhez amerikai kormányzati közvetítés kell, mert a cégek közötti direkt egyeztetés antitröszt-aggályokat vet fel.
  3. Globális koordináció. A legnehezebb lépés: az USA és szövetségesei megpróbálnák rábírni a tekintélyelvű rendszereket — elsősorban Kínát és Oroszországot — a lassításra és a közös biztonsági standardok elfogadására.

A The Verge beszámolója szerint a második lépés elsősorban a demokratikus országokban működő laborokra fókuszálna, mert a törvényhozás és a szabályozói infrastruktúra kiépítése időbe telik — addig az iparágnak önként kellene együttműködnie. A harmadik lépésnél Amodei egyszerre érvel a lassítás és a technológiai előny megőrzése mellett: szerinte az USA-nak és szövetségeseinek meg kell tartaniuk a vezetést Kínával szemben, a nagy teljesítményű chipekhez való hozzáférés korlátozásával és a desztilláció elleni fellépéssel — ez az a technika, amellyel egy versenytárs egy erősebb modell viselkedésének lemásolásával zárkózik fel.

Ez a kettősség a terv legsérülékenyebb pontja. Ugyanaz a dokumentum kéri a fejlesztés fékezését és a versenyelőny agresszív védelmét — a két cél a gyakorlatban nem mindig fér össze.

Kapcsolódó elemzésünk: Az AI elveszi a munkádat? — Amodei, Hinton és LeCun sem értenek egyet

2. Az Anthropic fenyegetés-jelentése: öt eset, nyolc hónap

A lassítási javaslat sürgősségét a cég saját fenyegetés-jelentése adja, amelyről az Axios számolt be részletesen. A jelentés szerint az Anthropic nyolc hónapig követte és hárította el a Claude visszaéléseit. Az öt dokumentált eset:

  • Irán-kötődésű célzási művelet az amerikai haditengerészet ellen: a Claude célzási kézikönyvek összeállításában segített — hajópozíciók, amerikai személyzet, légi és hajóazonosítók, műholdas képek, valamint hajómozgásokat felfedő weboldalak alapján. További Irán-kötődésű műveletek propagandára, belföldi megfigyelésre és ellenzéki, illetve kisebbségi célszemélyek beazonosítására használták a modellt.
  • Rakétacsapat „mérnöke” Jemenben: egy észak-jemeni fegyveres sejt a Claude Code-ot használta rakéta- és rakétavezérlő szoftverek fejlesztésére. Külön Claude-példányok írták a kódot, végeztek kutatást és ellenőrizték egymás munkáját — egy sikertelen rakétateszt után órákon belül visszatértek a modellhez hibakeresésért.
  • Ujgurok felkutatása: egy Kína-kötődésű szereplő több mint 100 WhatsApp-csoportot és több tucat Telegram-csatornát fésült át, hogy Szíriában tartózkodó ujgurokat azonosítson. A Claude egy nem arabul beszélő operátornak segített szíriai arab nyelven titkos megkeresést folytatni: fordított, és tanácsot adott a pénzügyi nehézségek, a családi szétszakítottság és a Hszincsiangban maradt rokonok kihasználására.
  • Országos megfigyelőrendszer egyetlen embertől: egy mali tanácsadó a Claude-ot használta fő mérnöki erőforrásként egy 25 millió telefonra kiterjedő rendszerhez, amely hívásnaplókat, SMS-eket és hangforgalmat gyűjt, hang alapján azonosít embereket különböző SIM-kártyák között, jelzi a VPN-használókat, és bírósági engedély nélkül generál hírszerzési dossziét bármely telefonszámról.
  • A megtagadott kérés máshová került: állami támogatású kutatók a chikungunya vírus módosításával próbálkoztak — fertőzőbbé tétel, illetve az immunválasz kijátszása — egy katonai kutatóintézet számára. A Claude blokkolta a legérzékenyebb kéréseket, ezért a platform egy gyengébb védelmű rivális modellhez irányította őket.

Az Anthropic emellett olyan orosz drónokat is azonosított, amelyek emberi jóváhagyás nélkül, önállóan válogatnak célpontokat. A jelentés egyik legélesebb megállapítása a laborok új szerepéről szól:

„A vezető AI-laborok akarva-akaratlanul saját jogukon is hírszerző ügynökségekké válnak.” — Anthropic fenyegetés-jelentés

Az ötödik eset a legtanulságosabb az egész lassítási vitában: ha egy modell visszautasít egy kérést, az nem jelenti, hogy a kérés nem teljesül. Az önkéntes szigor addig ér valamit, amíg a versenytársaknál is ugyanaz a küszöb — pontosan ezért kéri Amodei az iparági standardokat.

Kapcsolódó elemzésünk: Anthropic vs Pentagon: 5 kritikus etikai határ az AI-ban

3. Az iparág reakciója: egyetértés és egy lemondás

A javaslat a vártnál gyorsabb és pozitívabb visszajelzést kapott a vetélytársaktól. Sam Altman, az OpenAI vezérigazgatója röviden reagált:

„Egyetértek Darióval abban, hogy szabályoznunk kell az élvonalbeli fejlesztések ütemét.” — Sam Altman, OpenAI

Elon Musk reakciója ennél is rövidebb volt: „Dario is right.” Ez a két megszólalás azért fontos, mert a külső értékelők beengedése precedenst teremt: ha az Anthropic egyoldalúan megnyitja a kockázatértékelését, a versenytársak nehezebben tudják elkerülni a hasonló átláthatósági lépést. Az önkéntes vállalásból így de facto iparági minimum lehet — jogszabály nélkül is.

A belső front viszont feszültebb. A héten Jacob Coxon Anthropic-kutató biztonsági aggályok miatt lemondott, és a TechCrunch szerint azzal indokolta, hogy az AI-cégek „az életünkkel játszanak”, mert a fejlesztők maguk is úgy vélik, az AI „akár mindannyiunk vesztét okozhatja az évtized végére”.

Amodei javaslatának kiváltó eseményei között a TechCrunch az OpenAI–Hugging Face incidenst és az AI-fejlődés gyorsuló ütemét említi.

Amodei az átláthatóságot tette meg érvelése alapjának: „The public deserves to know what is going on.”

Kapcsolódó elemzésünk: OpenAI rogue AI-ágens: 4 napig garázdált, Altman a Kongresszus előtt magyarázott

4. Az OpenAI IPO 2027-re csúszik — biztonsági okokból

Ugyanazon a napon, 2026. szeptember 12-én Altman megerősítette, hogy az OpenAI nem lép tőzsdére 2026-ban, pedig a cég már benyújtott egy bizalmas IPO-jelentkezést. A Fortune-nak adott interjújában ezt mondta:

„Úgy vélem, mindent figyelembe véve, ami most a biztonság körül történik, kifejezetten rossz döntés lenne most tőzsdére lépni.” — Sam Altman, OpenAI

Ennél kategorikusabban is fogalmazott: „I would say not 2026, yeah. We’ve got a lot of stuff to do.” A TechCrunch szerint a New York Times még júniusban arról írt, hogy az OpenAI eredetileg 2026 harmadik vagy negyedik negyedévére tervezte a nyilvános megjelenést; a terv most 2027-re csúszott. Az okok között a tech-részvények volatilitása, a cég pénzügyi kihívásai és a biztonsági aggályok szerepelnek. A cégnél nemrég egy elszabadult („rogue”) AI-ágensek okozta hackelési incidens is történt. Altman szerint a cég akkor megy tőzsdére, amikor ő maga és a társadalom is készen áll a technológiára.

Kapcsolódó elemzésünk: OpenAI állami ügyészi vizsgálat: idézés érkezett az IPO előtt

5. Washington: kétpárti sürgetés, betiltási javaslat, elnöki ellenvélemény

A héten az amerikai politikában is napirendre került a téma, de három egymással összeegyeztethetetlen irányból. Egy kétpárti képviselőcsoport arra sürgeti Mike Johnson házelnököt, hogy törölje a kongresszusi szünetet, amíg a törvényhozás nem intézkedik. Bernie Sanders szenátor ennél messzebb megy: a szuperintelligencia teljes betiltását szorgalmazza. Donald Trump elnök viszont szeptember 11-én elutasította a kihalási félelmeket, és a Kínával szembeni AI-versenyt nevezte nagyobb veszélynek.

Vagyis miközben az iparág vezetői az önkéntes lassításról beszélnek, a szabályozói oldalon nincs közös nevező — sem a beavatkozás mértékéről, sem arról, hogy egyáltalán mi a fő kockázat. Ez pontosan az a helyzet, amire Amodei második lépése épül: ha a szabályozás késik, a kereteket a cégeknek kell felállítaniuk.

Kapcsolódó elemzésünk: Kínai katonai AI: OpenAI és Anthropic modelljeit másolták

Mit jelent ez a piacnak?

A hét három hírének — a lassítási tervnek, a fenyegetés-jelentésnek és az IPO csúszásának — egy közös üzenete van: a biztonsági kockázat átlépett a kommunikációs szintről az üzleti döntések szintjére. Amikor egy tőzsdére készülő cég vezérigazgatója biztonsági okokkal indokolja a halasztást, az már nem PR-kérdés, hanem értékelési és időzítési tényező.

A második következmény az auditálhatóság felértékelődése. Ha a beágyazott külső értékelő az Anthropicnál működni kezd, az a vállalati beszerzésekben is hivatkozási pont lesz: a nagyvállalati és közszolgálati vevők egyre inkább dokumentált kockázatértékelést kérhetnek a modellszolgáltatótól, nem csak benchmark-számokat.

A harmadik a modellválasztás kérdése. A jelentés ötödik esete megmutatta, hogy a szolgáltatók között érdemi különbség van abban, mit tagadnak meg. Ez a különbség eddig inkább kellemetlenség volt a felhasználóknak; mostantól megfelelési szempont.

A hét száma: 25 millió

Ennyi telefonra terjedt ki az a megfigyelőrendszer, amelyet egyetlen mali tanácsadó épített fel a Claude-ot fő mérnöki erőforrásként használva. A rendszer hívásnaplókat, SMS-eket és hangforgalmat gyűjt, hang alapján azonosítja ugyanazt a személyt különböző SIM-kártyák között, és bírósági engedély nélkül állít elő hírszerzési dossziét. A szám azért a hét legfontosabb adata, mert nem egy állami hírszerző ügynökség kapacitásáról szól, hanem arról, hogy egyetlen szakember egy kereskedelmi modellel milyen léptéket ér el.

A hét tippje: írd le, mi történik a megtagadott kéréssel

A fenyegetés-jelentés legátütőbb gyakorlati tanulsága nem a támadókról szól, hanem a belső folyamatokról: a legérzékenyebb kérést a Claude blokkolta, mire a kérés egy gyengébb védelmű modellhez került. Ha a cégednél több modellt használtok, három dolgot érdemes ma rögzíteni:

  • Ne kerüljétek meg a visszautasítást másik modellel. Legyen írott szabály, hogy az egyik szolgáltató által megtagadott kérés nem vándorol át egy engedékenyebb modellhez — ehelyett emberi felülvizsgálat következik.
  • Naplózzátok a visszautasításokat. A megtagadott kérések listája a legjobb belső jelzés arról, hogy hol feszülnek a munkafolyamataid a szolgáltató határaihoz — és hol kell folyamatot javítani, nem modellt váltani.
  • Kérdezd meg a szolgáltatót az értékelésről. Ha a külső, beágyazott értékelő iparági gyakorlattá válik, a beszerzési kérdéslistán is helye van: ki auditálja a modellt, milyen hozzáféréssel, és mit tesz közzé az eredményből.

Kitekintés

A következő hetekben három szálat érdemes figyelni. Az első, hogy az Anthropic egyoldalú vállalásából lesz-e tényleges, folyamatos külső hozzáférés, és követi-e az OpenAI — Altman elvi egyetértése még nem vállalás. A második a szabályozói oldal: a kétpárti sürgetés, Sanders betiltási javaslata és az elnöki álláspont közül melyik alakul konkrét jogszabállyá. A harmadik az OpenAI IPO-ja: ha a 2027-es időpont is a biztonsági helyzettől függ, akkor a tőzsdei naptár mostantól a biztonsági jelentéseket is követni fogja.

Az előző heti összefoglalónk: Gemini 3.8 Flash: hat hét, három új modell. Ha nem akarsz lemaradni a következő heti kiadásról, iratkozz fel az AI Hírek hírlevélre, és oszd meg az összefoglalót azzal, akinek szüksége van rá.

Vélemény, hozzászólás?

Az e-mail címet nem tesszük közzé. A kötelező mezőket * karakterrel jelöltük