A Mistral nyílt súlyú AI-modellje, a Le Chonk, kiberbiztonsági védelmet kínál
A Mistral új, nyílt súlyú Le Chonk (ML4) modellje előzetesben elérhető, és a cég állítása szerint a Kimi, Deepseek és Meta legjobb modelljeit is felülmúlja kiberképességekben.

A francia AI-labor, a Mistral bemutatta legújabb modelljét, a Mistral Large 4-et (ML4), amelyet „Le Chonk” néven is emlegetnek trillió paraméteres mérete miatt. A modell kifejezetten a kiberbiztonsági követelmények kielégítésére készült, és a cég szerint a felhasználók teljes kontrollját biztosítja, szemben a zárt modellekkel, amelyekhez a fejlesztők bármikor elvonhatják a hozzáférést. (ZDNet)
A „Le Chonk” elsősorban a kiberbiztonsági képességekre fókuszál, testreszabható kontrollt és adat-szuverenitást kínálva. A Mistral szerint a modell célja, hogy segítsen a vállalatoknak és kormányoknak megvédeni magukat a fenyegető szereplőkkel szemben, akik a zárt modelleket használják ki kibertámadásokhoz. A cég az Nvidia Open Secure AI Alliance nevű iparági partnerségének tagja, amely az AI-biztonsági incidensek elleni védekezés demokratizálását célozza.
A Mistral szóvivője szerint a Le Chonk kiberképességek terén felülmúlja a Kimi, Deepseek és Meta legjobb modelljeit. Bár a pontos benchmarkadatok még nem állnak rendelkezésre, korai elemzések alapján a modell bizonyos számítógépes látási feladatokban felveszi a versenyt a drágább, zárt modellekkel, mint például az OpenAI GPT-6 Astra-ja. A modell a pénzügyi és multimodális felhasználási esetekben is kiemelkedőnek bizonyul – állítja a Mistral.
A Le Chonk modell súlyai október 27-én válnak nyilvánosan elérhetővé. A Mistral egy hónapos előzetes időszakot biztosít a fejlesztők, kiberbiztonsági szakértők és hatóságok számára a modell képességeinek és viselkedésének valós környezetben történő értékelésére. Ez a gyakorlat hasonló az OpenAI és az Anthropic által alkalmazott módszerekhez, amelyek célja a modell képességeivel kapcsolatos aggályok kezelése.
A Mistral európai adatközpontjaiban, 4000 Nvidia Grace Blackwell GPU-n képezte ki a modellt két hónap alatt, ami jelentős erőforrás-megtakarítást jelent az OpenAI-hoz képest, amely becslések szerint 100 000 GPU-t használt a GPT-6 Astra betanítására. A cég tervei szerint a Le Chonk alapul szolgál majd a speciális és optimalizált modellek új generációjához.