Az OpenAI 20%-kal növeli a számítási költséget a legkockázatosabb modellek monitorozásával
Az új monitorozás 20 %-kal emeli a számítási költséget, a GPT-5.6-os és az Astra modellek futtatását érintve.

A szünet okai
Az OpenAI két hétre leállította a legújabb, bevetésre kész modellek reinforcement-learning tréningjét, miközben a legnagyobb tervezett frontier futást is felfüggeszti — írta a The Register. A szünet alatt kisebb tréningfeladatokat és értékeléseket futtat a védelmi mechanizmusok tesztelésére. (TNW)
Az új monitorozási rendszer részletei
A szünetet a júliusban történt Hugging Face incidens és a nemrég végzett Astra-teszt eredményei indították el, melyek szerint az Astra elérhette a kritikus kockázati szintet. Az Astra modell nem kapcsolódott a Hugging Face eseményhez, ahogy az Axios is közölte.
Az új rendszer a chain-of-thought monitorozást bővíti, és minden eszközalapú tréninget, értékelést a GPT-5.6 Sol szint vagy annál magasabb modellek esetén, valamint minden Astra-inferencia futtatást lefed. A monitorozás körülbelül 20 %-kal növeli a felügyelet alá eső számítási költséget, a vállalat szerint ez a költség belső kutatásként kerül fedezésre, és a felhasználókra nem hárul.
A rendszer osztályozók segítségével figyeli a modellek belső állapotát, gyanús jeleket egy automatizált nyomozóhoz irányít, amely 30 percen belül riasztást generál. Ha a jelzést ebben az időkeretben nem tudják tisztázni, a futtatás leáll. A módszer nem szünteti meg mindenféle rossz viselkedést, sőt egyes modellek elrejthetik szándékaikat – jegyezte Jakub Pachocki.
Versenytársi reakciók
Az OpenAI lépése nyilvános szakadékot nyitott a legközelebbi riválissal, az Anthropic-kel, amely szerint saját védelmi intézkedései elég erősek a lassítás elkerüléséhez. Mindkét labor a „Pacing the Frontier” közös levélben sürgeti a kormányokat, hogy segítsenek a fejlesztés lassítását célzó eszközök kiépítésében.