Az új AI-modellek veszélyeztetik az emberi felügyeletet – figyelmeztet az Anthropic
Az Anthropic legújabb modelljei 52-szer gyorsabbak, és egy mérnök kódtermelése nyolcszorosára nőtt két év alatt, miközben a mesterséges intelligencia már 80%-ban generál kódot.

Az Anthropic arra figyelmeztet, hogy a mesterséges intelligencia (AI) fejlődése olyan mértékben gyorsul, hogy az emberi felügyelet hamarosan ellehetetlenülhet. A cég belső jelentése szerint az új generációs modellek képesek lehetnek önmaguk fejlesztésére, ami példátlan biztonsági és kontrollproblémákat vet fel. A kutatók szerint a jövőbeli AI-rendszerek akár biológiai vagy kémiai fegyvereket is tervezhetnek, illetve valós időben képesek lehetnek komplex kibertámadások generálására.
A vállalat jelentése szerint a Claude modell legújabb iterációja 52-szer gyorsabban fut, mint 11 hónappal korábban. Az Anthropic mérnökei által generált kód 80%-át már AI-modellek állítják elő, és egy mérnök kódtermelése nyolcszorosára nőtt két év alatt. Az AI-rendszerek önállóan képes feladatok elvégzésének hossza négyhavonta megduplázódik.
Kapcsolódó: Anthropic Claude biztonság
Az emberi kontroll csökkenése
Az AI-modellek önálló működésre tervezett következő generációja emberi irányítás, parancsok vagy útmutatás nélkül fog működni. A „alignment” – a fejlett AI-modellek működési kontrolljára használt kifejezés – megoldása vagy annak hiánya a legkevésbé ismert tényező. Az Anthropic szerint a mai modellekben előforduló ritka félreigazodások súlyosbodhatnak, ahogy az új modellek utódokat építenek, mígnem elveszítjük felettük az irányítást.
Kapcsolódó: Claude Opus 4 javítása
Fegyverkezési verseny és sebesség
Az AI-fejlesztés sebessége exponenciálisan nő, amit a következő generációs AI-chipekhez való hozzáférés is gyorsít. A fejlesztési ciklusok hónapokról másodpercekre rövidülhetnek, mivel az AI képes saját kódjának folyamatos módosítására és tökéletesítésére. Ez a sebesség a globális biztonság szempontjából is aggasztó, mivel az AI képes lehet egyedi biológiai fegyverek és halálos vegyi anyagok tervezésére, amelyeket ember még csak nem is gondolt. A kibervédelmi fegyverek pedig valós időben képesek lehetnek „nulla-napi” támadásokat generálni és módosítani, példátlan méretű és sebességű hálózati behatolásokat végrehajtva.
Kapcsolódó: AI felügyelet kérdése
Az Anthropic egy komplex AI-fegyverzet-ellenőrzési folyamatot javasol, amelyhez a legfontosabb kihívásokat is megnevezi. A világon jelenleg több mint 300%-kal nő a chipkapacitás, és a TSMC vezeti a globális félvezetőgyártást. Az AI-iparág ellátási láncának ellenőrzése nélkül, beleértve a fizikai ellenőrzési mechanizmusok bevetését, a fejlett AI-modellfejlesztés leállítása kivitelezhetetlennek tűnik. Különösen Kína szerepe kérdéses, mivel a cég elemzése nem említi az országot a lehetséges együttműködők között.
Kapcsolódó: Claude forráskód szivárgás