A Cisco 900 nyílt AI-modellről készített ujjlenyomatot, hogy pótolja a hiányzó információkat
A nyílt AI-modellek 69%-ának származási hátterét korábban nem ellenőrizték, ám a Cisco új, ingyenes adatbázisa már 900 modell esetében kínál részletes információkat.

A nyílt forráskódú AI-modellek biztonsági átvizsgálása ma egy repozitóriumoldallal kezdődik, ahol a modell neve, licencelése és az alapmodell megjelölése szerepel. Ez utóbbi azonban csak egy feltöltő által megadott szöveges címke, amelyet a Hugging Face nem követel meg súlyszintű elemzéssel igazolni. Az Interconnects AI ATOM-jelentése szerint az Alibaba Qwen családja lett az új származtatott nyílt modellek 69%-ának megjelölt szülője, ami drasztikus növekedés a korábbi 1%-hoz képest. Kínai laborok összesen 70%-ot tesznek ki, míg Európa 4%-ot. A letöltések száma március végéig 2,04 milliárdot ért el. (VentureBeat)
Az adatbázis lefedettsége és működése
A Cisco csütörtökön publikálta az AI Supply Chain Provenance Explorer nevű, ingyenes nyilvános adatbázisát, amely közel 900 nyílt modellt fed le. Az egyes bejegyzések tartalmazzák a szolgáltató székhelyét, ujjlenyomat-alapú származási gráfját, licenckorlátozásait és a beolvasott fájlok számát. Az eszköz a Cisco Model Provenance Kit-re épül, egy áprilisban kiadott nyílt forráskódú Python-eszközcsomagra, amely nagyjából 150 alapmodellt katalogizált 45+ család és 20+ kiadó részvételével. A lefedettség egy negyedév alatt nagyjából hatszorosára nőtt.
Amy Chang, a Cisco AI Threat Intelligence and Security Research vezetője szerint az ellenőrzési hiányosságok komoly problémát jelentenek. Egy konferencián bemutatott 6986 multi-turn támadás ellen 15 zászlóshajó modell ellen, amelyek 88,3%-os sikerességi rátával bírtak. „Ha nem érted, hogyan fogékonyak a modellek a különböző típusú támadásokra, akkor nem tudod figyelembe venni, hogy az általad használt ügynököt vagy alkalmazást működtető modell hol hibázhat el” – mondta Chang.
Műszaki háttér és szabályozási környezet
Az Explorer azokat az adatokat is megjeleníti, amelyeket a Cisco már operationálisan használ. A cég Cerberus rendszere ellenőrzi a Hugging Face-re érkező modelleket, és olyan Secure Access szabályokat alkalmaz, amelyek blokkolják a kockázatos licencű vagy származási régiójú modelleket. Az Explorer ezt az információt ingyenesen és kereshetően teszi elérhetővé, Cisco termék nélkül.
Az Explorer a modellkapcsolatokat az önbevallott metaadatok helyett hasonlósági pontszámokra alapozza. A Cisco Model Provenance Kit két pontozott szakaszban működik. Az első szakasz az architektúra metaadatait hasonlítja össze a súlyok betöltése előtt. Ha a metaadatok kétértelműek, a második szakasz öt súlyszintű jelet von ki. A Cisco 96,4%-os pontosságot jelentett saját 111 pár-alapú benchmarkján.
Az Explorernek vannak korlátai. A közel 900 modell csak egy kezdő lépés, miközben a Hugging Face több mint 2 millió modellt tárol. Az ezen kívüli modellek továbbra is az önbevallott címkére támaszkodnak. A Cisco nem közölte, hogy az Explorer kínál-e API-t, ami nélkül egy csapat kézzel kereshet modellek után, de nem tudja beépíteni az ellenőrzést egy CI-kapuba. A hagyományos SCA (Software Composition Analysis) eszközök szerkezeti eltéréssel néznek szembe, mivel függőségi leltárakra és konténerképekre épültek.
Az AI Act végrehajtási hatásköre az Európai Bizottságra száll augusztus 2-án, akár 15 millió eurós vagy a globális forgalom 3%-ának megfelelő bírsággal.