Harmadik féltől származó AI-értékelésekre új szabványt adott ki az AI Evaluator Forum
Az AI Evaluator Forum közzétette az AEF-1 szabványt, amely alapvető követelményeket határoz meg a független harmadik fél AI értékelésekhez. A Xai, az OpenAI és az Anthropic is egyetértett a szabvánnyal.

Az AI Evaluator Forum (AEF) bemutatta az AEF-1 szabványt, amely lefekteti az alapvető követelményeket a harmadik féltől származó AI-értékelésekhez. A szabvány lefedi a hozzáféréssel, az érdekellentétekkel, a finanszírozási kapcsolatokkal, a kizárással és az átláthatósággal kapcsolatos kérdéseket. A dokumentumot a Xai, az OpenAI és az Anthropic is elfogadta, és elkötelezték magukat beágyazott értékelők biztosítása mellett. (Latent Space)
Beágyazott értékelők és hozzáférés
Az új szabvány célja, hogy ellenőrizze a biztonsági gyakorlatok betartását, elősegítse az incidensek jelentését, és felmérje a befejezett AI-modellek, valamint a képzési folyamatok alignáltságát. Az Anthropic egyoldalúan vállalta, hogy beágyazott értékelőit irodai asztalokkal, belépőkártyákkal és vállalati laptopokkal látja el, hasonló hozzáférést biztosítva számukra, mint amit a belső kockázatkezelő csapatok kapnak.
Piaci kontextus és függetlenség
A szabvány bevezetése része egy szélesebb körű vitának az AI biztonságáról és a fejlődés ütemezéséről (pacing). Dario, az eredeti kezdeményezés vezető szerzője szerint a beágyazott értékelők kulcsfontosságúak a tempózási kötelezettségvállalások ellenőrzéséhez, hasonlóan a banki szektorban alkalmazott gyakorlatokhoz. Az AEF-et 2025 decemberében alapították, és feltételezhetően a vezető harmadik fél auditorokat toborozza majd a nagy mesterséges intelligencia laboratóriumok számára az önreguláció keretében.
Felmerült az aggodalom, hogy a beágyazott értékelők függetlensége kérdéses maradhat, különösen a Kínával való együttműködés tempózási módszerei tekintetében, amelyek még spekulatívnak tűnnek. Az AEF-1 szabványt a Xai, az OpenAI és az Anthropic is elfogadta.