Az OpenAI biztonsági gyakorlatait az EU AI Act irányelveihez igazítja
Az OpenAI hozzájárult és elfogadta az EU általános célú AI (GPAI) Kódexét és a mesterséges intelligencia által generált tartalom átláthatóságáról szóló kódexet, hogy felkészüljön a közelgő szabályozási végrehajtásra.

A GPAI Kódex közös mércét állít fel az átláthatóság, a biztonság és a védelem terén az EU-ban értékesített vagy telepített általános célú modellek számára. Az OpenAI szerint már meglévő gyakorlatai, mint a modellek kiadás előtti tesztelése, a rendszerkártyák publikálása és a Red Teaming Networkön keresztüli külső tesztelés, közelítik a vállalatot ehhez a szinthez. Emellett a cég fenntart egy nyilvános Model Spec dokumentumot is, amely leírja, hogyan alakítják a modell viselkedését. (AI News)
Két belső keretrendszer a kockázatkezelésért
Két belső keretrendszer segíti ezt a munkát. A 2023 óta működő és 2025-ben frissített Preparedness Framework határozza meg, hogyan azonosítják, értékelik és kezelik a fejlett rendszerekből származó súlyos kockázatokat. Erre épül a különálló Frontier Governance Framework, amely részletezi, hogyan illeszkednek a cég biztonsági és védelmi gyakorlatai a jogi követelményekhez, különös tekintettel a GPAI Kódexre. Ezek a dokumentumok szabályozzák a kockázatértékelést, a védelmi intézkedéseket, a modelljelentést, a biztonsági helyzetet, az incidenskezelést és a külső szakértők bevonását a folyamatba.
Az OpenAI említi részvételét a Frontier Model Forumon, valamint együttműködéseit az amerikai Center for AI Standards and Innovationnal és a brit AI Security Institute-tal. Céljuk a megosztott biztonsági kutatás és a tisztább tesztelési teljesítménytesztek létrehozása az egész iparágban.
Az átláthatósági kódex és a tartalomproveniencia
Az átláthatósági kódex a mesterséges intelligencia által generált vagy módosított tartalmak azonosításának problémájára összpontosít. Az OpenAI két mechanizmust alkalmaz: a C2PA szabványon alapuló Content Credentials közvetlenül a fájlokhoz csatol kontextust, míg a SynthID vízjellel egy tartalékjelzést biztosít az adatok elvesztése esetére. A funkciók képekből audio kimenetekre terjeszkednek, és a cég dolgozik a további modalitások, köztük a szöveg támogatásán is.
A cég elismeri, hogy egyetlen jelzés sem elegendő, ezért rétegzett megközelítést alkalmaz, és folytatja a munkát a szélesebb szabványügyi közösséggel.
A biztonsági képességek, amelyek segítenek a védőknek a sebezhetőségek felderítésében és javításában, ugyanazokat a képességeket kínálják a támadóknak is. Az OpenAI erre a Trusted Access for Cyber programmal válaszol, amely a bevizsgált védőknek hozzáférést biztosít fejlettebb kibervédelmi képességekhez.