Az Anthropic kitiltja az AI-val szembeni kegyetlenkedőket
Az Anthropic megtiltja a felhasználóknak, hogy „kitartóan és céltalanul bántalmazó vagy kegyetlen” viselkedést tanúsítsanak a Claude AI modellel szemben, extrém esetekben.

Az Anthropic, a Claude chatbotot fejlesztő cég, új felhasználói szabályzatában tiltja a modellekkel szembeni „kitartó és céltalan bántalmazó vagy kegyetlen viselkedést”. A változtatás a cég „modelljólétre” irányuló kutatásának része.
A szabályozás csak „extrém esetekre” vonatkozik, ahol a felhasználók ismételten kegyetlenül viselkednek a modellel, minden látható cél nélkül. Nem vonatkozik azonban az általános felhasználói frusztrációkra, a modellek tesztelésére vagy „sötét kreatív témákra”.
Az AI-chatbotok jólétével kapcsolatos kutatás részeként az Anthropic tavaly augusztusban jelentette be, hogy lehetővé teszi a Claude számára, hogy megszakítsa a „kitartóan káros vagy bántalmazó” felhasználókkal folytatott beszélgetéseket. Ez továbbra is az elsődleges érvényesítési mechanizmus.
A cég szóvivője nem pontosította, hogy milyen viselkedés minősülne bántalmazónak vagy kegyetlennek, és nem nyilatkozott arról, hogy lesznek-e további érvényesítési mechanizmusok, mint például felhasználói kitiltások.
Az Anthropic vezetői, köztük Dario Amodei vezérigazgató, fontolgatják a gépi tudatosság kérdését. Amodei nem zárta ki a lehetőségét annak, hogy az AI rendszerek tudatosak lehetnek, míg riválisa, az OpenAI vezérigazgatója, Sam Altman, kényelmetlennek tartja az ilyen gondolatokat.
Háttér: Claude magyarul: mi fér bele az ingyenes keretbe
- Forrás: The Verge, The Guardian, CBS News