Több száz privát Claude-beszélgetés került nyilvánosságra keresőmotorokon keresztül
A Reddit-felhasználók több mint 200, személyes adatokat és céges titkokat tartalmazó beszélgetést találtak legalább 25 oldalon keresztül. A szivárgó csevegések között volt olyan, amely kiadatlan felhőbiztonsági cikkekhez kért segítséget.

Több száz, megosztásra szánt Claude AI-beszélgetés vált nyilvánosan kereshetővé a Google-ben. A felhasználók által létrehozott megosztott linkek révén olyan csevegések kerültek napvilágra, amelyek személyes neveket, elérhetőségeket, munkahelyi előzményeket és céges projektinformációkat tartalmaztak.
A Reddit felhasználói fedezték fel a problémát, amikor egy speciális kereséssel több mint 200 beszélgetést találtak legalább 25 oldalon keresztül. Ezek közül néhány mindössze hetekkel a felfedezés előtt keletkezett. A Google keresési eredményei a felfedezést követően eltűntek, de a probléma rávilágított arra, hogy a megosztott linkekkel létrehozott oldalak nyilvános weboldalként viselkedhetnek.
A szivárgó beszélgetések tartalma
A nyilvánosságra került csevegések között volt egy felhasználó, aki egy kiadatlan felhőbiztonsági cikkhez kért segítséget, amely részleteket tartalmazott egy céges projektről. Mások önéletrajzokhoz használták a chatbotot, amelyek neveket, elérhetőségeket és munkatörténeteket tartalmaztak. Néhány beszélgetés bizalmas egészségügyi kutatásokkal vagy magánbeszélgetések átirataival kapcsolatos volt.
Miért indexelték a lapokat?
A technikai probléma oka, hogy az Anthropic a megosztott csevegésekhez robots.txt szabályt használt, de a mintalapokból hiányzott a „noindex” utasítás. A Google dokumentációja szerint a robots.txt nem megbízható módszer arra, hogy egy weboldalt eltávolítsunk a keresési eredmények közül; ehhez „noindex” címke vagy jelszavas védelem szükséges. A megosztott linkekkel létrehozott snapshotok minden üzenetet tartalmaztak a megosztás előtt, és az azokban ismétlődő információk láthatóvá váltak.
Válaszok és következmények
Az Anthropic közölte, hogy a megosztott URL-ek nem voltak kitalálhatók vagy felfedezhetők, hacsak a felhasználók maguk nem osztják meg őket. A cég hangsúlyozta, hogy a felhasználók ellenőrzik a nyilvános link létrehozását, és figyelmeztetett, hogy a nyilvános webes tartalmakat külső szolgáltatások archiválhatják. A Google a weboldal üzemeltetőjére hárította a felelősséget, kijelentve, hogy a webhelyek tulajdonosainak „világos ellenőrzésük” van a feltérképezés és az indexelés felett.
Július 27-re a TechCrunch már nem tudta reprodukálni a Google keresési eredményeit, de ez nem garantálja a másolt vagy archivált verziók eltűnését.