ÉlőUtoljára: 10 perceMa: 25
Szabályozásfrissítve: 20:16

Az emberi felügyeletet helyezi előtérbe a Microsoft az új AI-kódexében

A Microsoft AI vezetője, Mustafa Suleyman szerint a cég hajlandó feláldozni a modellek teljesítményét, ha a biztonság veszélybe kerül. Az új irányelvek 2027-től vezérlik a fejlesztést, de csak a saját modellekre vonatkoznak.

Az emberi felügyeletet helyezi előtérbe a Microsoft az új AI-kódexében
Fotó: Tiago Oliveira / Unsplash
forrás: The Decoder·AI Forradalom szerk.·
Megosztás

A Microsoft csatlakozik az AI-fejlesztések lassítását sürgető hangokhoz. Új etikai kódexüket a cég saját modelljeinek képzésére és működtetésére szabták, de éles határvonalat húznak az Anthropic megközelítéséhez képest. (The Decoder)

Emberi felügyelet mindenek felett

A Microsoft AI által publikált kódex lefekteti az alapértékeket, viselkedési korlátokat és a konfliktuskezelés módjait. A dokumentum a képzés, a technikai ellenőrzés és az értékelés legfelső szintű irányelveként szolgál majd. A tervek szerint egy hathetes nyilvános konzultációt követően 2026 végére készül el a végleges verzió, amely 2027-től vezérli a modellfejlesztést. A kódex kizárólag a Microsoft saját modelljeire vonatkozik, nem terjed ki a platformon futó harmadik féltől származó modellekre.

A legfontosabb szabály, hogy az emberi kontroll mindenek felett áll. A Microsoft AI vezetője, Mustafa Suleyman szerint a cég hajlandó feláldozni a modellek általánosíthatóságát, autonómiáját vagy teljesítményét, ha a biztonság kerül veszélybe. „Ha valami nem biztonságos, nem építhetjük meg” — nyilatkozta a The Informationnak.

Érthető gondolatmenet, nem „Neuralese”

A kódex előírja, hogy az MAI modelleknek el kell fogadniuk a felhatalmazott személyek által kezdeményezett megszakításokat, korrekciókat és leállításokat. Nem bővíthetik saját hatáskörüket, nem rejthetik el tevékenységeiket, és csak friss jóváhagyással működhetnek a megbeszélt ponton túl. Ezek a korlátok az általuk megbízott alügynökökre is vonatkoznak.

A Microsoft különösen határozottan fogalmaz a gondolatmenet nyomon követhetőségével kapcsolatban. A modellek nem használhatnak „Neuralese”-t vagy más, az emberek számára érthetetlen kommunikációs formákat, sem saját érvelésük során, sem más AI rendszerekkel való kommunikációban. Az indoklás szerint az emberek egyszerűen nem tudják felügyelni, amit nem értenek.

A kódex elismeri, hogy az érthető gondolatmenet önmagában nem oldja meg a kontroll problémáját, mivel a modellek megtanulhatják manipulálni azt. A Microsoft nem ösztönzi az „mesterséges belső élet” illúzióját.

Nincs tudatosság, nincsenek jogok

A kódex alapötlete hasonlít az Anthropic Claude-hoz készült alkotmányához, amely szintén egy legfelső szintű dokumentumként alakítja a modell viselkedését. A két cég azonban alapvetően eltér abban, ahogyan modelljeikre gondolnak. A Microsoft AI-modelljei nem utánozhatnak tudatosságot, nem állíthatnak magukról, hogy érzéseik vagy belső motivációjuk van, és a cég elutasít minden jogra vagy jólétre vonatkozó igényt velük szemben.

Ezzel szemben az Anthropic a Claude-ot egy újfajta entitásként írja le, és stabil identitást kíván ösztönözni, részben biztonsági okokból. Az alkotmányuk nyitott kérdésként kezeli a lehetséges szubjektív tapasztalatot és a morális státuszt. A Microsoft vezérigazgatója, Satya Nadella is támogatta a lassításra irányuló felhívást, akárcsak az OpenAI, az xAI és a Meta vezetői. A Microsoft nyitott arra is, hogy külső auditorok ellenőrizzék, valóban lassítják-e a fejlesztéseket, írja a The Information.

A kódex felülvizsgált változata várhatóan 2026 végén készül el, és 2027-től lép életbe.

Forrás

Feldolgozott sajtóforrás·The Decoder

Eredeti cikk megnyitása →

Ez a cikk a fenti sajtóforrás alapján készült AI-összefoglalóval.

tetszett a cikk? oszd meg →
Megosztás

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom