ÉlőUtoljára: 5 perceMa: 23
Üzlet & Startupfrissítve: 15:20

Az AI-ügynökök token-költségét csökkenti az Okta új szűrővel

Az Okta új módszert vezet be az AI-ügynökök token-költségeinek csökkentésére: az identitásalapú Model Context Protocol (MCP) szűrésével lenullázza a „tool tax”-ot.

Az AI-ügynökök token-költségét csökkenti az Okta új szűrővel
Fotó: Annie Spratt / Unsplash
forrás: AI News·AI Forradalom szerk.·
Megosztás

Az Okta szerint az identitásalapú Model Context Protocol (MCP) eszközkatalógusok szűrésével csökkenthetők az AI-ügynökök token-költségei. Minden modellhívás tartalmazza az MCP szerver által közzétett összes eszköz sémáját, nevét, leírását és paramétereit. Az Okta ezt a felhalmozódó prompt-többletet „tool tax”-nak nevezi — írja a mesterséges intelligencia portál. (AI News)

A cég érvelése szerint ez a költség már azelőtt felmerül, mielőtt az ügynök egyáltalán megkísérelne egy eszközt hívni. Egy jogosulatlan kérés későbbi elutasítása sem tudja visszanyerni az elköltött prompt-tokeneket. Az Okta által javasolt vezérlés szűri az eszközök listáját, mielőtt az a modellhez érkezne, az ügynök identitásához és a hozzá társított felhasználóhoz rendelt engedélyek alapján.

MCP eszközkémák generálnak prompt-többletet minden körben

Az MCP szerverek egyre inkább az AI-ügynökök és az eszközök, illetve adatok összekapcsolásának útjává váltak. Az Okta példaként említi a Google Workspace-szel, a Slackkal és belső MCP szerverekkel való kapcsolatokat. Egy MCP szerver nagyszámú eszközt tehet elérhetővé, és a modell minden körben megkapja az elérhető eszközök reprezentációját a promptjában. Ez a reprezentáció tartalmazza az eszközkémát, az eszköz nevét, leírását és paramétereit is.

Az Okta szerint a költség akkor növekszik, ha egy széles körben használt MCP szerver sok eszközt tesz elérhetővé. Minden aktív felhasználó prompt-többletet generál, amikor az ügynöke modellhívást kezdeményez. A cég ezt egyszerre kezeli eszköz- és felhasználószám-problémaként.

A probléma hozzáférésszabályozási dimenzióval is bír. Egy olyan ügynök, amely a saját engedélyezési körén kívül eső eszközöket lát, megpróbálhatja használni azokat. A futásidejű elutasítás blokkolhatja a végrehajtást, de a modell már megkapta az eszközdefiníciót, és tokeneket használt fel annak feldolgozásához.

Az Okta az ügynök promptjának felépítése előtt szűri az eszközöket

Az Okta képességet a „biztonságos, ügynökalapú vállalati megoldások tervrajza” részeként pozicionálja. Ez arra kéri a szervezeteket, hogy azonosítsák ügynökeiket, engedélyezett kapcsolataikat és jogosult cselekedeteiket. Megközelítésük a kapcsolódás kérdését egy teljes MCP szerverhez való hozzáférésről az adott szerveren lévő egyedi eszközökhöz való hozzáférésre szűkíti.

Egy rendszergazda az Okta irányítópulton konfigurálja azokat az eszközöket, amelyeket egy adott identitás használhat. Az Okta ezután a szerver teljes katalógusa helyett a szűrt eszközkészletet adja vissza. Az ügynök ezt a rövidebb listát kapja meg promptként minden körben. Az Okta szerint futásidőben ismét ellenőrzik a hatókört, mielőtt egy eszközhívás végrehajtódna.

Ez a kialakítás az eszköz szintjén alkalmazza a legkisebb jogosultság elvét. A cég szerint egy ügynöknek nem szabad tudomást szereznie olyan erőforrásokról, adatbázisokról vagy eszközökről, amelyeket nem kapott kifejezetten használatra felhatalmazást. Az elérhetetlen eszközök eltávolítása a promptból csökkenti a modellhívás sémaköltségét is.

Az Okta belső modellezése kimutatta, hogy egyes engedélyezési forgatókönyvek több mint 90%-kal csökkentették a látható eszközök számát.

Forrás

Feldolgozott sajtóforrás·AI News

Eredeti cikk megnyitása →

Ez a cikk a fenti sajtóforrás alapján készült AI-összefoglalóval.

tetszett a cikk? oszd meg →
Megosztás

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom