Új adaptív AI-bíró vigyáz a vállalati chatbotokra, AdaGuard csökkenti a késleltetést
Az AdaGuard felügyelt finomhangolással és megerősítéses tanulással készült, így futásidőben általánosít a biztonsági politikákra.

Az AdaGuard egy új, adaptív LLM-as-a-Judge keretrendszer, amely a vállalati generatív AI-alkalmazások biztonságát hivatott erősíteni. A korábbi megoldások merevségével szemben az AdaGuard dinamikus szabálykövetést és rugalmas érvelési költség-allokációt kínál, így képes megfelelni a változó kockázati elvárásoknak és a szigorú késleltetési követelményeknek.
A kutatók által bemutatott rendszer felügyelt finomhangolással (SFT) és megerősítéses tanulással (GRPO) készült. Ez lehetővé teszi, hogy az AdaGuard futásidőben általánosítsa a felhasználó által definiált biztonsági és megfelelőségi politikákat anélkül, hogy gyakori modellfrissítésekre lenne szükség. Az AdaGuard képes felismerni az input-politika párok összetettségét, és ennek megfelelően váltani a gyors, fekete-dobozos következtetés és az átlátható, érvelésalapú moderálás között.
Az AdaGuard képességei révén felveszi a versenyt a nála többször nagyobb méretű guardrail és élvonalbeli modellekkel. Az automatikus érvelési módja pedig a késleltetés töredékéért képes visszaállítani a folyamatosan aktív érvelés pontosságát — állítják a kutatók az arXiv előnyomtatott tanulmányukban.
A rendszer rugalmassága segíti a fejlesztőket az erős késleltetési követelmények és az átláthatóság iránti igény egyensúlyának megteremtésében. Az AdaGuard a tervek szerint csökkenti a vállalati chatbotok válaszadási idejét, miközben biztosítja a biztonsági és megfelelőségi előírások betartását. A kutatás eredményei a 2610.08923v1 azonosítójú tanulmányban érhetők el.