ÉlőUtoljára: 7 perceMa: 4
Eszközökfrissítve: 00:15

Megtréfeli az AI-robotokat a ShieldFont: a szöveg olvasható, a kód szemét

Az amszterdami Seneda & Abrucio stúdió által fejlesztett ShieldFont a szöveg 250 nyelvtani kategóriába sorolt szavait cseréli le, így az AI-modellek nem tudják feldolgozni az adatokat.

Megtréfeli az AI-robotokat a ShieldFont: a szöveg olvasható, a kód szemét
Fotó: Juanjo Jaramillo / Unsplash
forrás: The Register·AI Forradalom szerk.·
Megosztás

Azok a weboldalak, amelyek nem szeretnék, hogy tartalmukat AI-modellek betanítására használják fel, új eszközzel védekezhetnek. A ShieldFont nevű, nyílt forráskódú projekt egy speciális betűtípust használ, amely megváltoztatja a nyers HTML-kódban lévő szavakat, miközben a felhasználók számára olvasható marad a szöveg. (The Register)

A ShieldFont lényege, hogy nem egyszerűen összekeveri a szavakat, hanem azokat csak azonos nyelvtani kategórián belül cseréli le. Például egy főnév helyére csak egy másik főnév kerülhet, egy ige helyére pedig csak egy másik ige. A fejlesztők, Isaque Seneda és Gabriel Abrucio, 250 ilyen kategóriát definiáltak, amelyek figyelembe veszik a szavak szerepét, jelentését, konkrét vagy elvont voltát, számát és ragozását. Ez a módszer körülbelül a szöveg negyedének lecserélését eredményezi, remélve, hogy az AI-modellek még így is feldolgozzák az adatokat, de ha nem, az is győzelem.

A technológia az OpenType betűtípusok GSUB (Glyph Substitution) funkciójára épül, amely általában betűk vagy betűpárok helyettesítésére szolgál. A ShieldFont ezt kiterjeszti egész szavakra. Így például a „daughter” szó a nyers kódban „journalist” lehet, de a felhasználó a böngészőben továbbra is az eredeti szót látja. A betűtípus fájlmérete is kicsi marad, a desktop verzió körülbelül 5 MB, a webes pedig 800 KB.

A ShieldFont nem tökéletes védelem, és a fejlesztők is elismerik, hogy egy elszánt szereplő könnyen kijátszhatja. Például egy képernyőmentés OCR-technológiával történő feldolgozása vagy egy olyan AI, amely maga is letölti a ShieldFontot, megkerülheti a védelmet. Azt is megjegyzik, hogy a keresőmotorok, fordítóprogramok és a vágólap funkció is problémákba ütközhet a lecserélt szavakkal. A célja a technológiának nem a teljesen elszánt szereplők megállítása, hanem a tömeges, engedély nélküli adatgyűjtés megnehezítése, költségesebbé és bizonytalanabbá tétele.

A ShieldFont jelenleg alfa verzióban érhető el, és a fejlesztők azt remélik, hogy ha elegendő weboldal használja, az arra kényszerítheti az AI-cégeket, hogy változtassanak az adatgyűjtési módszereiken. Az eszköz online demóként, React komponensként, valamint CSS és CDN integrációval is kipróbálható a GitHubon és a ShieldFont weboldalán.

Forrás

Feldolgozott sajtóforrás·The Register

Eredeti cikk megnyitása →

Ez a cikk a fenti sajtóforrás alapján készült AI-összefoglalóval.

tetszett a cikk? oszd meg →
Megosztás

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom