ÉlőUtoljára: 1 órájaMa: 24
Szabályozásfrissítve: 20:16

Kevesebb mint 1% másolt NYT-cikkeket a Microsoft Copilotból

A Microsoft szerint a Copilot több mint 8,2 millió chatnaplója közül kevesebb mint 1%-ban fordult elő legalább 16 szó egyezés a hírtartalmakkal, miközben a kiadók lopással vádolják a céget.

Kevesebb mint 1% másolt NYT-cikkeket a Microsoft Copilotból
Fotó: Fionn Große / Unsplash
forrás: The Verge·AI Forradalom szerk.·
Megosztás

A per részeként a Microsoft 8,2 millió Copilot chatnaplót adott át egy, a hírkiadók által megbízott szakértőnek. A naplókat állítólag azért válogatták ki, mert „kulcsszavakat tartalmaztak a Hír-felperesek weboldalainak használatára utalva, így a legvalószínűbb, hogy Hír-felperesek műveit tartalmazzák". A Microsoft szerint az elemzés kimutatta, hogy ezek közül 59 545 naplóban volt legalább 16 közös szó a modell alapjaként használt hírtartalmakkal. (The Verge)

A Center for Investigative Reporting (CIR) szakértője 51 esetet talált „jelentős átfedésre" a CIR munkájával az adatkészletben. Hasonlóképpen, egy szerzői perben a szakértő megállapította, hogy a 8,2 millió beszélgetésből csak 24 válasz tartalmazott legalább 30 egyező szót. A 212 értékelt könyv közül mindössze 10 mutatott egyezést.

A kiadók vádja

A The New York Times vitatja a Microsoft következtetéseit. „A bizonyítékok során feltárt dokumentumok és tanúvallomások csak egyetlen következtetésre vezetnek: a Microsoft és az OpenAI ellopta a The New York Times-tól a sajtóját pótló, üzleti tevékenységét fenyegető és iparágát aláásó kereskedelmi termékek előállításához" — közölte Ian Crosby, a lap vezető jogtanácsosa. A CIR és az Authors Guild nem kívánt kommentárt fűzni az ügyhöz.

A tisztességes felhasználás érve

A Microsoft szerint az adatok alátámasztják az érvelését, miszerint a szerzői joggal védett tartalmak AI-képzési adathalmazokban való felhasználása tisztességes felhasználásnak (fair use) minősül. Bár az olyan rendszerek, mint a Copilot, szerzői jog által védett anyagokat használnak, az így létrejött rendszereket a cég szerint jelentősen eltérő célokra használják, mint az eredeti művek. Az, hogy néha szövegrészeket reprodukálnak, „aligha alázzák alá az LLM-képzés transzformatív célját" — érvel a Microsoft.

A beadványok egy olyan jogi csata részei, amelyet kiadók és szerzők indítottak a Microsoft és az OpenAI ellen. A felperesek azt állítják, hogy a cégek az ő műveikre építve hoztak létre termékeket, és most közvetlenül versenyeznek velük, részben a szerzői jog által védett tartalmak reprodukálásával.

A hírkiadók és a könyvszerzők követeléseit egy bíró előtt egyesítették a folyamat egyszerűsítése érdekében, a kiadók és a szerzők tiltakozása ellenére. A Microsoft pénteken nyújtotta be a beadványt, miközben arra kérlelte a bírót, hogy hozzon korai szakaszban lezáró ítéletet. A Trump-adminisztráció is nyilatkozatot tett a New York Times ügyében, támogatva az OpenAI-t.

A Microsoft állítása szerint a kiválasztott naplók „különösen azért kerültek kiválasztásra, mert kulcsszavakat tartalmaztak a Hír-felperesek weboldalainak használatára utalva", ami torzíthatja a mintát. Az az érv, hogy az alacsony átfedés „aligha alázzák alá a transzformatív célt", a bíróságon kívül nem igazolt. A Trump-adminisztráció nyilatkozatában kifejezte támogatását az OpenAI-val szemben.

Forrás

Feldolgozott sajtóforrás·The Verge

Eredeti cikk megnyitása →

Ez a cikk a fenti sajtóforrás alapján készült AI-összefoglalóval.

tetszett a cikk? oszd meg →
Megosztás

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom