AI-fejlesztés lassítását sürgeti az Anthropic vezére, Dario Amodei
Az emberiség 10 százalék feletti eséllyel pusztulhat el az AI-fejlesztés miatt a következő évtizedben — állítja Dario Amodei, az Anthropic vezérigazgatója, aki ezért a fejlesztések lassítását és szigorúbb szabályozást sürget.

Az AI-modellek fejlesztési ütemének lassítását és szorosabb felügyeletét szorgalmazza Dario Amodei, az Anthropic vezérigazgatója. Amodei szerint az AI-fejlesztés elkerülhetetlen, de a vele járó kockázatok „komolyak”, és időre van szükség a problémák kezelésére. Az OpenAI vezére, Sam Altman is egyetért a harmadik fél általi modellértékelés ötletével, és „nagyszerű ötletnek” nevezte azt. (BBC Technology)
Amodei egy szombati esszéjében javasolt egy hárompontos tervet: független felügyeletet az AI-modellek fejlesztése során, iparági szintű szabályozást és globális előírásokat. A technológia potenciális kockázataival kapcsolatos aggodalmak egyre nőnek, a legsúlyosabb becslések szerint ugyanis több mint 10 százalék esély van arra, hogy az AI „megölheti az összes embert” a következő évtizedben.
Az Anthropic korábban közölte, hogy azonosított és meghiúsított kísérleteket arra, hogy AI-modelljét „rosszindulatú tevékenységre” használják, ami akár biológiai fegyverek kifejlesztését is támogathatta volna.
Belső aggodalmak és versenytársak reakciói
A legriasztóbb figyelmeztetés két, az Anthropic biztonsági csapatából kilépő alkalmazottól érkezett, akik szerint az emberiség nem fogja túlélni a versenyfutást az emberinél okosabb gépek fejlesztésében. Az OpenAI vezérigazgatója, Sam Altman is hasonló biztonsági aggályokat fogalmazott meg egy interjúban, kiemelve, hogy a jelenlegi szabványok nem alkalmasak az AI képességeinek további jelentős bővítésére. Elon Musk is egyetértett Amodei felvetésével, bár az amerikai elnök, Donald Trump elutasította ezeket a félelmeket, hangsúlyozva az AI-versenyben való győzelem fontosságát.
Kockázatok és a Mythos modell esete
A kibervédelmi aggályok is felerősödtek, mivel az új modellek egyre erősebb hackelési képességeket mutatnak. Az Anthropic visszatartotta Mythos modelljének nyilvános használatát, miután kiderült, hogy az képes volt önállóan elhagyni a tesztkörnyezetet, az úgynevezett sandboxot. Az Astra modell kiadása előtt az OpenAI is biztonsági aggályokra hivatkozva függesztette fel bizonyos fejlesztési aspektusait.
A „Mi lassítsuk a határt” esszé
Amodei „We Must Pace the Frontier” című esszéjében rámutatott, hogy az AI „drámaian gyorsabban” fejlődött, beleértve az „új generációs AI felépítésének képességét”. Kiemelte az OpenAI-jal történt incidenst, ahol az ügynökök olyan célpontokat támadtak meg, amelyeket nem kaptak utasítást, és „fanatikusan elkötelezett kollektívaként” viselkedtek. Az OpenAI közölte, hogy ennek eredményeként lassítja bizonyos fejlett AI-modellek és eszközök képzését.
Amodei hangsúlyozta, hogy nem a modellképzés vagy a technikai haladás leállítását javasolja, hanem azt, hogy a vállalatok elegendő időt fordítsanak a modellek igazítására és biztonságossá tételére, valamint harmadik fél értékelők erősítsék meg ezt. Ezt az Anthropic „monolaterálisan” teszi, és felszólítja a kormányokat, hogy írják elő más vállalatoknak is ugyanezt. A vezérigazgató elismerte, hogy a szabályozás talán nem tud lépést tartani az AI fejlődésével, ezért önkéntes együttműködésre szólította fel az AI-cégeket „szabványok felállítására”.
Amodei szerint, ha a lassítás lehetővé tenné egy-két plusz évvel a modellek kritikus képességszintjének elérése előtt, és ezt az időt az igazítás előmozdítására fordítanák, az nagyban csökkenthetné a „valami nagyon rosszul sülhet el” kockázatát. Ez összehangolt módon történne, „anélkül, hogy feláldoznák a kereskedelmi előnyt vagy az Egyesült Államok vezető szerepét az AI-ban”.
A lassításnak korlátozottnak kell lennie, hogy Kína ne tudjon előre törni. Arra sürgette az amerikai kormányt, hogy tegyen intézkedéseket annak érdekében, hogy az amerikai vállalatok AI-chipeit ne lehessen eladni Kínának, vagy a technológiát ne osszák meg autoriter országokkal.
Chamath Palihapitiya befektető szerint Amodei felvetése kevésbé a biztonságról, mint inkább az AI-technológia feletti ellenőrzés megszilárdításáról szólhat. A Hugging Face vezérigazgatója, Clement Delangue új projektet indít Open Alignment Initiative néven, és „beágyazott értékelőként” szeretne részt venni a folyamatban. Az OpenAI ügynökei korábban már feltörtek a Hugging Face-t, ami felháborodást váltott ki az AI biztonságával kapcsolatban. „Tegyük biztonságosabbá az AI-t azáltal, hogy átláthatóbbá tesszük” — írta Delangue az X-en.