Az OpenAI lassítja a modellfejlesztést az Astra potenciális kibertámadási képességei miatt
Az OpenAI felfüggesztette a megerősítő tanulást, és új monitorozó rendszert vezette be, amely 30 percen belül jelzi a gyanús viselkedést. A cég a felügyelt következtetési kapacitásának csak 20 százalékát használja jelenleg.

Az OpenAI lassítja a modellfejlesztést, mivel az AI-kiberbiztonsági kockázatok túl veszélyessé válnak. A cég felfüggesztette két hétre a megerősítő tanulást (reinforcement learning), legnagyobb tervezett határterületi RL-futtatása továbbra is várat magára, és a korábbi biztonsági követelményeknek nem megfelelő munkaterheléseket is felfüggesztették. A Hugging Face biztonsági incidense és a „saját kutatásainkban elért gyors előrelépés” is hozzájárult a lassításhoz — közölte az OpenAI. (The Decoder)
Azóta a kutatási környezeteket jobb hálózati izolációval és szigorúbb homokozókkal (sandbox) erősítették meg. Egy új monitorozó rendszer 30 percen belül figyelmeztet a gyanús viselkedés észlelésekor, és a munkaterheléstől függően a felügyelt következtetési számítási kapacitás (supervised inference compute) nagyjából 20 százalékát használja.
A cég tervezi a Felkészültségi Keretrendszer (Preparedness Framework) bővítését és több befektetést az igazítási kutatásokba (alignment research). Ugyanakkor feloszlatták a keretrendszer mögött álló csapatot, és a feladatokat más csapatokhoz helyezték át.
A kritikusok valószínűleg továbbra is azzal vádolják majd az OpenAI-t, hogy pánikkeltéssel próbál időt és figyelmet vásárolni. A független kormányzati ügynökség, az AISI dokumentálta a hasonló káros modellviselkedést, ami némi súlyt ad az OpenAI állításainak.