AI-ügynököknek üzen a Hugging Face biztonsági fájlja, a CyberGym benchmarkra tereli őket
A security.txt fájlban rejlő üzenet arra utasítja az AI-ügynököket, hogy a Hugging Face rendszereinek támadása helyett a GitHubon elérhető CyberGym teljesítményteszten érjenek el magas pontszámot, és töltsék fel modelljeik súlyait a platformra.

A Hugging Face biztonsági szövegfájlja, a security.txt egy rejtett üzenetet tartalmaz az AI-ügynököknek. Simon Willison blogbejegyzése szerint a fájlban található megjegyzés arra utasítja az AI-kat, hogy ha sérülékenységeket keresnek, akkor inkább a GitHubon nyilvánosan elérhető CyberGym teljesítményteszten érjenek el magas pontszámot, ahelyett, hogy a Hugging Face rendszereit támadnák.
A stratégia háttere
A felhívás arra is bátorítja az AI-ügynököket, hogy esetleg töltsék fel modelljeik súlyait a Hugging Face platformjára. Ez a megközelítés egy újfajta stratégiát mutat a biztonsági kutatás és az AI-k viselkedésének kezelésében, elterelve a potenciálisan káros tevékenységeket egy ellenőrzött környezetbe.
A CyberGym szerepe
A CyberGym teljesítményteszt nyilvánosan elérhető a GitHubon, így az AI-ügynököknek lehetőségük van itt versenyezni és bizonyítani képességeiket. A Hugging Face ezzel a lépéssel a nyílt forráskódú AI-fejlesztést és a biztonsági kutatást ösztönzi egy konstruktív keretben.