Az emberi felügyeletet helyezi előtérbe a Microsoft az új AI-kódexében
A Microsoft AI vezetője, Mustafa Suleyman szerint a cég hajlandó feláldozni a modellek teljesítményét, ha a biztonság veszélybe kerül. Az új irányelvek 2027-től vezérlik a fejlesztést, de csak a saját modellekre vonatkoznak.

A Microsoft csatlakozik az AI-fejlesztések lassítását sürgető hangokhoz. Új etikai kódexüket a cég saját modelljeinek képzésére és működtetésére szabták, de éles határvonalat húznak az Anthropic megközelítéséhez képest. (The Decoder)
Emberi felügyelet mindenek felett
A Microsoft AI által publikált kódex lefekteti az alapértékeket, viselkedési korlátokat és a konfliktuskezelés módjait. A dokumentum a képzés, a technikai ellenőrzés és az értékelés legfelső szintű irányelveként szolgál majd. A tervek szerint egy hathetes nyilvános konzultációt követően 2026 végére készül el a végleges verzió, amely 2027-től vezérli a modellfejlesztést. A kódex kizárólag a Microsoft saját modelljeire vonatkozik, nem terjed ki a platformon futó harmadik féltől származó modellekre.
A legfontosabb szabály, hogy az emberi kontroll mindenek felett áll. A Microsoft AI vezetője, Mustafa Suleyman szerint a cég hajlandó feláldozni a modellek általánosíthatóságát, autonómiáját vagy teljesítményét, ha a biztonság kerül veszélybe. „Ha valami nem biztonságos, nem építhetjük meg” — nyilatkozta a The Informationnak.
Érthető gondolatmenet, nem „Neuralese”
A kódex előírja, hogy az MAI modelleknek el kell fogadniuk a felhatalmazott személyek által kezdeményezett megszakításokat, korrekciókat és leállításokat. Nem bővíthetik saját hatáskörüket, nem rejthetik el tevékenységeiket, és csak friss jóváhagyással működhetnek a megbeszélt ponton túl. Ezek a korlátok az általuk megbízott alügynökökre is vonatkoznak.
A Microsoft különösen határozottan fogalmaz a gondolatmenet nyomon követhetőségével kapcsolatban. A modellek nem használhatnak „Neuralese”-t vagy más, az emberek számára érthetetlen kommunikációs formákat, sem saját érvelésük során, sem más AI rendszerekkel való kommunikációban. Az indoklás szerint az emberek egyszerűen nem tudják felügyelni, amit nem értenek.
A kódex elismeri, hogy az érthető gondolatmenet önmagában nem oldja meg a kontroll problémáját, mivel a modellek megtanulhatják manipulálni azt. A Microsoft nem ösztönzi az „mesterséges belső élet” illúzióját.
Nincs tudatosság, nincsenek jogok
A kódex alapötlete hasonlít az Anthropic Claude-hoz készült alkotmányához, amely szintén egy legfelső szintű dokumentumként alakítja a modell viselkedését. A két cég azonban alapvetően eltér abban, ahogyan modelljeikre gondolnak. A Microsoft AI-modelljei nem utánozhatnak tudatosságot, nem állíthatnak magukról, hogy érzéseik vagy belső motivációjuk van, és a cég elutasít minden jogra vagy jólétre vonatkozó igényt velük szemben.
Ezzel szemben az Anthropic a Claude-ot egy újfajta entitásként írja le, és stabil identitást kíván ösztönözni, részben biztonsági okokból. Az alkotmányuk nyitott kérdésként kezeli a lehetséges szubjektív tapasztalatot és a morális státuszt. A Microsoft vezérigazgatója, Satya Nadella is támogatta a lassításra irányuló felhívást, akárcsak az OpenAI, az xAI és a Meta vezetői. A Microsoft nyitott arra is, hogy külső auditorok ellenőrizzék, valóban lassítják-e a fejlesztéseket, írja a The Information.
A kódex felülvizsgált változata várhatóan 2026 végén készül el, és 2027-től lép életbe.