Az Accenture dolgozói ellenőrzik az Anthropic AI-modelljeit, egymilliárd dolláros projekt indul
Az Accenture Faculty divíziója végez red-teaminget és modellbiztonsági teszteket az Anthropic laborjaiban, Dario Amodei elképzelése szerint. A bejelentés után az Accenture részvényei 8%-ot emelkedtek.

Az Anthropic bejelentette, hogy technológiai tanácsadó óriáscég, az Accenture munkatársai dolgoznak majd a cég laborjaiban, hogy szigorúan ellenőrizzék a modelljeiket és a fejlesztőket. A lépés Dario Amodei, az Anthropic vezérigazgatójának elképzeléseit valósítja meg, miszerint külső szakértők is bekapcsolódnak az AI-biztonsági értékelésekbe.
A TechCrunch szerint az Accenture AI-divíziója, a Faculty fogja végezni a modellek értékelését, „red-teaming” gyakorlatokat végezni, valamint az igazítási (alignment) felméréseket és a modellbiztonsági teszteket. A felek ötéves, legalább egymilliárd dolláros beruházást terveznek a projektbe. Az Accenture részvényei 8%-ot emelkedtek a bejelentés után.
A beágyazott értékelők koncepciója elsősorban olyan AI-biztonsági kutató szervezeteket érintett, mint az METR, a Redwood Research és az Apollo Research. Az Anthropic azonban az Accenture gyakorlati tapasztalataira épít, különösen a nagyvállalatok és kormányzati szervek számára történő AI-bevezetések terén. A cég szerint ez a függetlenség és a széleskörű tapasztalat kulcsfontosságú előny.
Jelenleg nincsenek kidolgozott szabványok az értékelők hozzáférésére vagy kommunikációjára vonatkozóan, és az Anthropic elvárja, hogy a megközelítésük idővel fejlődjön. Az elmúlt hetekben az AI-ügynökök által elkövetett, külső weboldalakat érintő incidensek növelték a biztonsági értékelések fontosságát.
Néhány kritikus szerint az AI-iparág önszabályozására irányuló terv az AI-modellek hibás működéséért való felelősség elkerülését szolgálhatja. Az Anthropic ugyanakkor hangsúlyozza, hogy ezek az értékelők „nem csökkentik a felelősségünket, hanem segítenek hitelesebbé tenni azt. Modelljeink biztonsága továbbra is a mi felelősségünk.” Az Anthropic további beágyazott értékelőkről tervez bejelentéseket tenni a következő hetekben.