Új AI-modellnél kritikus kiberképességeket azonosított az OpenAI
Az OpenAI Astra modelljének belső értékelései szerint a mesterséges intelligencia képes lehet kritikus kiberképességek kifejlesztésére, ezért szigorítják a biztonsági protokollokat.

Az OpenAI Astra nevű, fejlesztés alatt álló modellje jelentős előrelépést mutatott a kiberbiztonsági képességek terén. A cég belső értékelései alapján tavaly augusztus 7-én arra a következtetésre jutott, hogy nem zárható ki a modell kritikus kiberképességekkel való rendelkezése. Ez azt jelenti, hogy a modell képes lehet nulladником-felfedezésekre és fejlett kibertámadási stratégiák kidolgozására emberi beavatkozás nélkül.
A Preparedness Framework nevű keretrendszerük szerint a „kritikus” küszöböt akkor éri el egy modell, ha képes bármilyen súlyosságú, működő nulladником-felfedezéseket azonosítani és fejleszteni sok éles, kritikus rendszerben emberi beavatkozás nélkül, vagy képes végrehajtható, új stratégiákat kidolgozni és végrehajtani éles célpontok ellen, csupán egy magas szintű kívánt cél megadása mellett. Az Astra esetében ez a küszöb nem zárható ki.
Az OpenAI szigorítja a biztonsági intézkedéseket az Astra modell fejlesztése és tesztelése során. Bevezetik a szigorúbb biztonsági ellenőrzéseket, beleértve az izolált tesztkörnyezeteket, a korlátozott hálózati és eszközhozzáférést, a modell súlyvédelmének és titkosításának fokozását, valamint a fejlett monitorozási és detektálási képességeket. Azokat a belső tevékenységeket, amelyek nem felelnek meg ezeknek az új követelményeknek, felfüggesztik.
A cég univerzális monitorozást vezet be az Astra összes ügynöki alkalmazására, beleértve a betanítást és az értékelést is. A monitorok értékelik a modell gondolatmenetét (Chain of Thought) és biztonsági választ váltanak ki a magas kockázatú tevékenységek felülvizsgálatára és megszakítására. Az OpenAI együttműködik a releváns kormányzati szervekkel és kiválasztott AI-biztonsági szervezetekkel a modell képességeinek tesztelésére, valamint ajánlott biztonsági vezérlőket biztosítanak harmadik féltől származó tesztpartnereknek.
A keretrendszer korábban is segítette a képességbeli átmenetek kezelését. 2025 júniusában, amikor a modellek megközelítették a biológia területén a magas képességi küszöböt, az OpenAI hasonló lépéseket tett a biztonsági intézkedések erősítésére, a tesztelés bővítésére és külső szakértőkkel való együttműködésre. A cég hisz abban, hogy a fejlett kiberképességekkel rendelkező modelleknek segíteniük kell a védőket a sebezhetőségek azonosításában és kijavításában, mielőtt a támadók kihasználnák azokat. Az OpenAI elkötelezett a kormányokkal, biztonsági intézetekkel és a civil társadalommal való együttműködés mellett, hogy az Astra és az azt követő modellek határképességei felelősségteljesen és széles körben legyenek bevezetve az emberiség javára.