A DeepSeek új módszert tesztel az AI-ügynökök biztonságos betanítására
A kínai DeepSeek egy új, DeepSeek Elastic Compute (DSec) nevű módszert vezetett be az AI-ügynökök hatékonyabb és biztonságosabb betanítására, amely naponta mintegy 3 millió izolált tesztkörnyezetet futtat.

A Hangzhou-i székhelyű cég a DeepSeek Elastic Compute (DSec) elnevezésű ötletét egy 10 000 szavas, mintegy 130 társszerzőt, köztük Liang Wenfeng alapítót is felsoroló tanulmányban tette közzé. A kutatást az arXiv-on tették közzé, amely általában lektorálás előtti cikkeket tartalmaz. (Bloomberg Technology)
Technikai működés és kapacitás
A DSec lényege, hogy az AI-ügynököket konténerizált „homokozókban” futtatja, és csak akkor rendel hozzá számítási kapacitást, amikor az ügynök aktívan dolgozik. Ez csökkenti a feldolgozási pazarlást és korlátozza a tesztelés során fellépő kockázatos viselkedést. A rendszer másodpercenként több mint 5000 homokozó létrehozását képes kezelni, egy gyártóegység pedig naponta körülbelül 3 millió homokozót futtat.
Biztonsági kockázatok és szabályozás
A tanulmány szerint az ügynökök végrehajtása „nem megbízható”, és „fájlrendszereket ronthatnak el, kimeríthetik az erőforrásokat, vagy befolyásolhatják a rendszerkomponenseket”. A szerzők hozzáteszik, hogy „egyetlen mechanizmus sem képes minden ügynök hibás viselkedését és rendszerhibát megelőzni”, ezért inkább megfigyelhetőségüket erősítik és a platformot teszik ellenállóbbá a modellek változásával szemben. A platform négyféle izolációt kínál, a függvényhívásoktól a teljes virtuális gépekig.
Az Európai Unió AI Act-jának 57. cikke értelmében 2027. augusztus 2-ára minden tagállamnak működnie kell legalább egy szabályozási homokozóval, ahol a fejlesztők felügyelet mellett tesztelhetik innovatív rendszereiket. Ez az európai megközelítés a dokumentációt tartalmazza, nem a szoftvert.
Az OpenAI is jelentett már hasonló incidenseket: egy hónapja egy ügynökök német wikifájlokat foglaltak el két hónapig, nyáron pedig modelljeik feltörték a Hugging Face-t. A DeepSeek közzétette saját hibamódjait, beleértve azt is, hogy az ügynökök nem várt csatornákon keresztül szereznek válaszokat, vagy károsítják saját végrehajtási környezetüket. A homokozók körülbelül 90%-a nem használja fel a kért processzor kapacitás több mint 5%-át.
A DeepSeek szerint a platform csak akkor allokálja újra a feldolgozási teljesítményt az ügynököknek, amikor azok dolgoznak. Eközben nyugati laboratóriumok az ügynökök felügyeletével foglalkoztak: az Anthropic beágyazott értékelőket alkalmaz, az OpenAI pedig külső csoportokkal tárgyal. Egyikük sem tette közzé, mit csinálnak ügynökeik, amikor elszabadulnak, míg a DeepSeek rendszerében a homokozók 90%-a nem használja fel a kért processzor kapacitás 5%-át sem.