ÉlőUtoljára: 9 perceMa: 30
Modellek & LLMfrissítve: 21:16

Trillió paraméteres modellt dobott piacra a Mistral

Az egy trillió paraméteres Mistral Large 4 (ML4) modell előzetes verziója már elérhető API-n keresztül, a súlyok várhatóan október végén érkeznek.

Trillió paraméteres modellt dobott piacra a Mistral
Fotó: Winston Chen / Unsplash
forrás: The Decoder·AI Forradalom szerk.·
Megosztás

Az Artificial Analysis Intelligence Index szerint az ML4 38 pontot ért el, ami jelentős előrelépés a korábbi, 9 pontos Mistral Large 3-hoz képest. Azonban a vezető zárt modellek, mint a Claude Opus 5.5 (58 pont), továbbra is messze előtte járnak. A modell jelenleg is saját fejlesztésűnek minősül, mivel a súlyokat még nem adták ki. A súlyok megjelenéséig a Mistral biztonsági cégekkel és kormányzati ügynökségekkel teszteli a modellt, csökkentett moderációval és kibővített kiberképességekkel. (The Decoder)

Kiemelkedő a kiberbiztonságban

A Mistral bejelentésének jelentős részét az IT-biztonság kapja. A cég szerint az ML4 az Artificial Analysis Cyber Indexben az öt legjobb modell közé tartozik, és a Kínán kívüli nyílt súlyú modellek között messze vezet. Egy teszt során a modell képes volt reprodukálni és javítani egy nyílt forráskódú szoftver valós sebezhetőségét, 82%-os eredményt elérve.

Ezzel szemben a Claude Opus 5.5 és a GPT-6 Astra a feladat elutasítása miatt közel nulla pontot értek el. A Mistral szerint ez a képesség kulcsfontosságú a szoftverek védelmében, mivel a zárt modellek biztonsági szűrői pont ezt a munkát blokkolják, miközben a támadók könnyedén kijátsszák azokat.

Második helyen a kódolásban

Programozási feladatokban az ML4 49,8%-os eredményt ért el az Artificial Analysis Coding Agent Indexben, megelőzve a Deepseek V4 Pro és a Qwen3.8 Max modelleket. Egy vak értékelésen a Surge AI segítségével végzett tesztben az ML4 a második helyet szerezte meg öt modell közül, 3,74 ponttal az 5-ből, megelőzve a GLM-5.3 és a Kimi K3 modelleket. A Claude Opus 5 végzett az élen 4,22 ponttal. Az emberi értékelők az ML4-et részesítették előnyben STEM és CAD feladatokban, míg a pénzügyi és kódolási területeken a modellek hasonlóan teljesítettek.

A Mistral szerint az ML4-et 3800 Nvidia Grace Blackwell GPU-n, saját európai adatközpontjaiban tanították. A modell egy egymillió tokenes kontextusablakkal rendelkezik, és a tervek szerint egy új generációs, speciális Mistral modellek alapjául szolgál majd. A cég a 3 milliárd eurós Series D befektetési körből származó forrásokból finanszírozza a fejlesztéseket. Az ML4 ára előzetes verzióban 0,68 dollár per egymillió bemeneti token és 2,09 dollár per egymillió kimeneti token.

Forrás

Feldolgozott sajtóforrás·The Decoder

Eredeti cikk megnyitása →

Ez a cikk a fenti sajtóforrás alapján készült AI-összefoglalóval.

tetszett a cikk? oszd meg →
Megosztás

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

☕ Támogatom