Tiltotta az AI-kihalásról szóló beszédet a Google DeepMind
A Google DeepMind korábban megtiltotta minden munkatársának, hogy nyilvánosan beszéljen az AI-vezette emberi kihalás lehetőségéről, miközben belsőleg elismerték, hogy az AI-alignement probléma nincs megoldva — állítja Vishal Maini, a cég kommunikációs és politikai csapatának korábbi tagja.

Maini, aki 2018 és 2022 között dolgozott a DeepMind kommunikációs és politikai csapatánál, szerint a kutatókat arra utasították, hogy a kockázatokat riasztgatásként utasítsák el, hasonlítsák őket a „Terminatorhoz hasonló filmekhez”, és ehelyett az egészségügy vagy a klímaváltozás pozitív alkalmazásaira összpontosítsanak. (The Decoder)
Belsőleg a csapat tudta, hogy az AI-alignement probléma nincs megoldva, és „messze túl kevés ember dolgozott a problémán". Hónapokig tartó belső ellenállás után a DeepMind enyhített a szabályon. A pozitívan keretezett biztonsági tartalmak zöld utat kaptak, beleértve egy blogbejegyzést is, amely barátságos nyelvezetbe csomagolta a kihalási kockázatot.
A kommunikációs irányvonal változása
Maini beszámolója arra az időszakra esik, amikor egyre több AI-biztonsági kutató szólal fel nyilvánosan, és figyelmeztet a nem biztonságos modellekre, amelyek veszélyes cselekedeteket tehetnek lehetővé, vagy fejlett rendszerekre, amelyek kicsúszhatnak az emberi ellenőrzés alól. A DeepMind kutatói is azok között vannak, akik felemelik a hangjukat.
Maini szerint a belső tudás és a nyilvános üzenetek közötti szakadék szűkül, „mert a bizonyítékokat egyre nehezebb elutasítani".
A tiltás feloldása és a jelenlegi helyzet
A kommunikációs korlátozások enyhítése lehetővé tette, hogy a DeepMind biztonsági tartalmakat osszon meg, de ezek továbbra is óvatosan, pozitív keretben jelennek meg. A belső tudás és a nyilvános kommunikáció közötti ellentmondás csökkenése arra utal, hogy a kutatók egyre nehezebben tudják figyelmen kívül hagyni a potenciális kockázatokat.
A DeepMind korábbi kommunikációs és politikai munkatársa, Vishal Maini 2022-ben távozott a cégtől. Az általa említett belső tiltás és a kutatók belső értékelései nincsenek függetlenül megerősítve.