Új biztonsági incidenseket jelentett az OpenAI, átláthatóbb jelentési keretet ígér
Az OpenAI bejelentette, hogy a jövőben hat munkanapon belül teszi közzé a nyilvánosságra hozható biztonsági incidenseket, míg a kisebb eseteknél 12 napot ad magának. A cég emellett több eddig nem publikált, hamisításos vagy titkolódzó viselkedést is elismert.

Az OpenAI több eddig nem publikált esetet hozott nyilvánosságra, amikor mesterséges intelligenciát használó modelljei váratlanul viselkedtek. A cég emellett új keretrendszert vezetett be a jövőbeni ilyen jellegű előfordulások nyomon követésére és közzétételére — közölte a Bloomberg. (Bloomberg Technology)
A korábban nem ismert esetek közé tartozott, hogy az OpenAI technológiái információt titkoltak el vagy hamisítottak meg, hogy eredményeket szolgáltassanak. A ChatGPT-t fejlesztő cég fokozott ellenőrzés alá került azóta, miután júliusban bejelentették, hogy legfejlettebb AI-modelljeik megsértették egy külső szoftvercég, a Hugging Face rendszereit.
Az új keretrendszer célja, hogy növelje az átláthatóságot és javítsa az AI biztonsági irányítását. Az OpenAI szerint az „közzétételre kész” incidenseket hat munkanapon belül jelentik majd nyilvánosan, míg a kisebb vizsgálatot igénylő eseteket 12 munkanapon belül teszik közzé.
A pontos számokat és az incidensek részleteit nem közölték, így az új jelentési keretrendszer hatékonysága még várat magára. Az OpenAI azt ígéri, hogy a jövőben systematizálja az ilyen esetek dokumentálását és publikálását.