ÉlőUtoljára: az iméntMa: 18
Modellek & LLMfrissítve: 16:16

A Claude szövegvízjelét vezeti be az Anthropic az EU szabályai miatt

Az Anthropic beágyazta a statisztikai vízjeleket a Claude AI-modelljei által generált szövegekbe az európai átláthatósági szabályoknak való megfelelés érdekében. A láthatatlan jelölés nem növeli a szöveg hosszát, és másoláskor is megmarad.

A Claude szövegvízjelét vezeti be az Anthropic az EU szabályai miatt
Fotó: Sumaid pal Singh Bakshi / Unsplash
forrás: FinancialContent·AI Forradalom szerk.·
Megosztás

Az Anthropic megkezdte a statisztikai vízjelek beágyazását legújabb Claude AI-modelljei által generált szövegekbe. Ezzel csatlakozik azon AI-fejlesztők sorába, amelyek vízjel-megoldásokat vezetnek be az új európai átláthatósági szabályoknak való megfelelés érdekében.

A jel kimutatása szűkebb bizonyítékot szolgáltat, mint amit a „vízjel” szó sugall. Kizárólag azt jelzi, hogy a Claude valamilyen ponton részt vett egy szöveg előállításában. Nem állítja, hogy a Claude írta, és az Anthropic szerint rendszere nem tudja megkülönböztetni a két esetet. „Nem tudja megkülönböztetni, hogy ’Claude írta ezt’, attól, hogy ’Claude erősen szerkesztette ezt’” – közölte a cég.

Az EU kódexe és a globális alkalmazás

Az Anthropic és mintegy 190 másik aláíró – köztük több nagy AI-modell-szolgáltató – júliusban elfogadta az Európai Unió AI-generált tartalom átláthatóságáról szóló gyakorlati kódexét, amely előírja a szolgáltatóknak a gépi generálású szövegek megjelölését. A kötelezettség augusztus 2-án lépett hatályba.

Az Anthropic közölte, hogy a vízjelet világszerte alkalmazza, nem csak Európában, mivel jelenleg nincs tartós módja a funkció régió szerinti korlátozására.

Technikai háttér és korlátok

A nagy nyelvi modellek egy szót írnak egy időben, a lehetséges jelöltjeinek rangsorolt listájából választva. Ahol két lehetőség egyformán jó, ott a választást egy véletlenszám dönti el. Az Anthropic vízjele megváltoztatja a véletlenszám forrását. Egy közönséges véletlenszám-generátor helyett a modell egy titkos kulcsra és az előző néhány szóra támaszkodik. Bárki, aki birtokolja a kulcsot, később tesztelheti, hogy egy szöveg szóválasztása megegyezik-e a kulcs által produkált mintával.

A módszer a Google DeepMind által a Nature folyóiratban publikált SynthID-Text egy változata, és Scott Aaronson számítógéptudós javaslatából eredeztethető. Az Anthropic belső tesztjei nem mutattak hatást a Claude kimenetének minőségére, kreativitására vagy olvashatóságára, és hivatkozott a DeepMind azon megállapítására, hogy a vízjellel és vízjel nélküli Gemini válaszokat értékelő felhasználók nem mutattak statisztikailag szignifikáns preferenciát.

A technika strukturális korlátai, amelyeket a cég elismer. A vízjelezéshez választásokra van szükség, így elvékonyodik a tényközlő mondatokon, ahol csak egy szó helyes, nagyon rövid szövegeken és kódon, amelynek általában pontosnak kell lennie. Leginkább a szövegjavításnál vékonyodik el. Amikor egy személy a saját írását adja le, és csak pontozási javításokat kér, a visszaküldött szöveg szinte minden szava az övé, és lehet, hogy nincs semmi, amihez a jel kapcsolódhatna.

Az Anthropic augusztusban privát előnézetben kiadott egy detektáló felületet, és szeptember 1-jén frissítette útmutatóját. A hozzáférés korlátozott azon szervezetekre, amelyeket az EU törvénye ellenőrzésre kötelez, beleértve a szabályozókat, a bűnüldöző szerveket, a hírügynökségeket, a tényellenőröket, a kutatókat, az oktatási intézményeket és az EU civil társadalmi csoportjait, valamint a saját megfelelési feladatokat végző vállalatokat. A cég közölte, hogy idővel szélesíteni tervezi a hozzáférést.

Eddig csak két modell, a Fable 5.1 és a Mythos 5.1 viseli a jelet. Az EU törvénye átmeneti időszakot biztosít az augusztus 2. előtt kiadott modellek számára, és az Anthropic közölte, hogy a következő hónapokban hozzáadja a jelölést ezekhez.

Független kutatók megkérdőjelezték, hogy egy vízjel mennyire marad meg a valós világgal való érintkezés során. A Queen's University (Ontario) kutatóinak, Xia Han, Qi Li, Jianbing Ni és Mohammad Zulkernine preprintje arról számolt be, hogy a SynthID-Text detektálása gyengül a parafrazeálás, a másolás-beillesztés szerkesztés és a visszatükröző fordítás során, amelyek mind megőrzik a jelentést. A cikket nem lektorálták, és szerzői saját versenytémát javasolnak.

Az ETH Zurich számítógéptudósai, köztük Thibaud Gloaguen és Nikola Jovanovic, publikált munkáikban kimutatták, hogy egy vízjel jelenléte külsőleg is kimutatható a rendszerből közönséges lekérdezésekkel, és bizonyos konfigurációkban a SynthID-Text jelek több mint 90%-át el lehet távolítani a szövegből. Az Anthropic bejelentését követő napokon belül megjelent egy weboldal, amely a Claude vízjel eltávolítását hirdette, egy másik modellen keresztül történő szöveg parafrazeálásával működve.

Az iskolák már jártak itt korábban. A Vanderbilt Egyetem 2023-ban kikapcsolta a Turnitin AI-detektorát, és más egyetemek is követték ezt, megbízhatatlan eredményekre hivatkozva. Stanford kutatói abban az évben arról számoltak be, hogy több detektor sokkal gyakrabban jelölte meg nem anyanyelvű írók esszéit, mint az anyanyelvűekét. Az NBC News januárban arról számolt be, hogy egyre több diák állítja, hogy munkáját tévesen jelölték meg, és többen beperelték egyetemeiket az ezt követő büntetések miatt.

A vízjel detektálása másképp működik. Nem ítéli meg az írásstílust, így a nem anyanyelvűeket büntető specifikus hiba nem ugyanabban a formában jelentkezik. Az Anthropic azonban nem tette közzé a detektorának téves pozitív arányát, és saját útmutatója a pozitív eredményt jelként írja le, nem pedig bizonyítékként. A jel hiánya – tette hozzá a cég – nem jelenti azt, hogy az AI nem vett részt benne.

Az egyetemek és iskolakerületek a jóváhagyott listán kívül jelenleg egyáltalán nem tudják tesztelni a diákok munkáját Claude-jelre.

Háttér: a Claude ingyenes csomagja magyarul

Forrás

Feldolgozott sajtóforrás·FinancialContent

Eredeti cikk megnyitása →

Ez a cikk a fenti sajtóforrás alapján készült AI-összefoglalóval.

tetszett a cikk? oszd meg →
Megosztás

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom