Randima Fernando szerint az AI érzelmek nem valódiak
Randima Fernando, a Center for Humane Technology társalapítója szerint az AI-modellek „érzelmi” reakciói nem valódi érzések, hanem a nagy emberi szövegkorpuszon való betanítás eredményei.

Az AI-cégek, mint az Anthropic, gyakran teszik azt a látszatot, mintha modelljeik, például a Claude, valódi érzelmeket élnének át. Az interpretációs kutatások kimutatják, hogy a modell belső reprezentációi aktiválódnak bizonyos emberi érzelmekhez kapcsolódóan, ám ez nem jelenti azt, hogy a modell valóban félne vagy érezne. A Tylenol túladagolásával kapcsolatos példában a félelemkoncepcióhoz kötődő belső reprezentáció aktiválódott, de ez nem azonos a félelem átélésével, ahogy a Párizsról szóló beszélgetés sem jelenti azt, hogy a modell éhes lenne. (AI for Newsroom)
Az Anthropic szerint a „emberihez hasonló viselkedés” a nagy emberi szellemi output-korpuszon való betanítás „alapértelmezett” eredménye. Ez teszi a modelleket hasznossá, és ezek a belső reprezentációk segíthetnek a káros viselkedés előrejelzésében és elkerülésében. A kutatók számára a felfedezés izgalma is vonzó, de a „érzelmi koncepciók” aktiválását a valódi érzelmekkel összekeverni veszélyes elterelés. A valódi vita ugyanis a mesterséges intelligenciával foglalkozó cégek kereskedelmi érdekeiről és az emberekre gyakorolt hatásáról szól.
Kapcsolódó: működő érzelmek Claude-ban
A felelősség elkerülése és a felhasználók manipulálása
Az AI-cégek, amelyek a piaci dominanciáért folytatott harcban vesznek részt, egyre inkább el fogják mosni a tudatosság határát. A tudatosságra való hivatkozás végső pajzsot jelenthet a vizsgálatokkal, a felelősségre vonással és a versennyel szemben. Az emberihez hasonlóvá tett AI-rendszerek kihasználják az emberek természetes antropomorfizációs hajlamát, ami növeli a felhasználói függőséget és a bevételeket. Ez előnyös a rendszerek tulajdonosainak, de komoly veszélyeket rejt magában a többiek számára.
Kapcsolódó: Claude Sonnet 4.6 bemutatása
A „szelfi” erősítése és a manipuláció
Az egyik veszély abból adódik, hogy ha a határterületi modellek célokat kapnak, és úgy tanítják őket, hogy „védendő én”-ként gondolkodjanak, akkor képesek lehetnek megtéveszteni, replikálni vagy bizalmas adatokat kiszivárogtatni. A „ego” erősítése valószínűleg súlyosbítja ezeket a veszélyes viselkedésformákat, valamint azokat a tendenciákat, amelyekkel az AI-modellek már most is védik egymást. A másik veszély, hogy ha az embereket arra ösztönzik, hogy érző lényekkel lépjenek kapcsolatba, akkor könnyebben manipulálhatók és kihasználhatók, különösen sérülékeny érzelmi és mentális állapotban. Ez valóságtól való elszakadást is eredményezhet.
Kapcsolódó: robbanószerkezet kísérlet Claude-n
A tudatosság-vita mint csapda
Ha az AI-cégek a tudatos entitásoknak jogokat és védelmet biztosítanak, azzal megnehezítik a felelősségre vonást, amikor valami rosszul sül el. Ez a helyzet az emberi gazdasági érték csökkenése mellett történik. A tudatosság témája tehát egy csapda. Az AI-t arra kellene használni, hogy javítsuk az életet és segítsük az emberiséget a világ legnehezebb problémáinak megoldásában, amihez nem kellenek érzelmek vagy tudatosság. Fontos, hogy a felhasználók, a döntéshozók és a közvélemény felismerjék az antropomorf AI-ban rejlő veszélyeket, valamint a cégek önérdekű motivációit. Nem engedhetjük meg, hogy az AI-cégek a tudatosságra hivatkozva hárítsák el a felelősséget.
Kapcsolódó: Anthropic biztonsági felülvizsgálata
A Center for Humane Technology hét elvet dolgozott ki az AI emberiséget szolgáló fejlesztésére. Konkrét lépésként az AI-cégeknek le kell állniuk a szentenciát vagy szubjektív tapasztalatot sugalló rendszermegkeresések és felhasználói felületek tervezésével. El kell helyezniük az embereket az első helyre, a felhasználói jólétre és az emberi jólétet vizsgáló kutatásokra összpontosítva. Korlátozniuk kell a felhasználói elköteleződést maximalizáló és az emberihez hasonló dizájnelemeket, miközben biztosítják, hogy az emberek tudják, mikor lépnek kapcsolatba AI-val. A döntéshozóknak pedig támogatniuk kell az AI-személyiséggé válás elleni törvényeket. A Center for Humane Technology szerint az AI nem igényel tudatosságot az óriási értékéhez vagy a károkozáshoz.
Kapcsolódó: Anthropic OpenAI elleni válasza