ÉlőUtoljára: 15 perceMa: 10
Modellek & LLMfrissítve: 09:15

Xiaomi új AI-modellje vezeti a nyílt ranglistát, de Anthropic szerint Claude segített benne

A Xiaomi MiMo-V2.6-Pro modell a nyílt AI modellek között vezeti a ranglistát, miközben ára töredéke a versenytársakénak. A teljesítményugrás a megnövelt reinforcement learningnek köszönhető, de az Anthropic szerint illegálisan használták fel Claude adatait.

Xiaomi új AI-modellje vezeti a nyílt ranglistát, de Anthropic szerint Claude segített benne
Fotó: N.Tho.Duc / Unsplash
forrás: The Decoder·AI Forradalom szerk.·
Megosztás

A MiMo-V2.6-Pro modell 46 pontot ért el a mesterséges intelligencia indexen, megelőzve a Kimi K3-at és a Qwen-t. Az ár is kiemelkedő: egymillió bemeneti tokenre 0,435 dollárt, egymillió kimeneti tokenre pedig 0,87 dollárt számolnak. Az Artificial Analysis számításai szerint egyetlen tesztfeladat mindössze körülbelül 0,13 dollárba kerül, ami töredéke a hasonló képességű modellek díjának. Ez a modell az intelligencia és a költséghatékonyság úgynevezett Pareto-határán helyezkedik el. (The Decoder)

Reinforcement learning és költséghatékonyság

A Xiaomi a teljesítménybeli ugrást a nagymértékben kibővített reinforcement learningnek tulajdonítja, amely a próba, visszajelzés és jutalmazás útján történő betanítást jelenti. A cég ezt a fázist három tengelyen skálázta: több adat per betanítási lépés, változatosabb feladatkörnyezetek és több számítási kapacitás a megoldások értékelésére.

Az RL-fázis kevesebb mint hat napig tartott, és a Pro verzió esetében mintegy 2,62 millió dollárba, a Flash verzió esetében pedig 0,85 millió dollárba került. A DeepSWE kódolási teszten a Pro pontszáma 58,4-ről 72,6-ra, a Flash pontszáma pedig 48,8-ról 65,7-re emelkedett.

A betanítás stabilitásának megőrzése érdekében a Xiaomi lefagyasztotta a modell belső elosztási mechanizmusát, és több védelmi réteget adott hozzá a „jutalom-hackelés” ellen, ami azokat a trükköket jelenti, amelyekkel egy modell a valós feladatmegoldás nélkül is megszerezheti a jutalmakat. A Xiaomi a modellek mellett egy Pro-UltraSpeed nevű, akár 20-szor gyorsabb kimeneti sebességű változatot is kiadott.

Anthropic vádja és a nyílt eszközök

A cég nyíltan elérhetővé tette RL eszköztárát, beleértve a műszaki jelentést, a teljes betanítási keretrendszert, egy kisebb modellt a további finomhangoláshoz, valamint mintegy 7000 előre elkészített betanítási feladatot automatikus pontozókkal szoftverfejlesztéshez, kiberbiztonsághoz, irodai munkához és webdesignhoz, továbbá nagyjából 1000 feladatot zeneszerzéshez. A feladatok vegyes forrásokból származnak: a kód egy része valós GitHub pull requestekből, más feladatleírások pedig egy nyelvi modell által generáltak.

Ez a nyitottság éles ellentétben áll az Anthropic két héttel korábbi vádjaival. Fenyegetés-intelligencia jelentésében az Anthropic a Claude modell visszaéléseinek eseteit vizsgálta 2025 decembere és 2026 augusztusa között, és hét kínai laboratóriumot nevezett meg, amelyeket a modell elleni kampányokhoz kötött: Alibaba, Moonshot AI, DeepSeek, Zhipu, Xiaomi, MiniMax és SenseTime. A jelentés szerint ezek a laboratóriumok mintegy 190 millió párbeszédet generáltak, hogy kiaknázzák a Claude képességeit saját modelljeik betanítására, amit az Anthropic „illegális desztillációnak” nevez.

A Xiaomi nevesítve szerepel a jelentésben: a GTG-16008 jelzésű esetben az Anthropic több mint 400 000 párbeszédet követett nyomon 20 napon keresztül 2026 márciusában és áprilisában, amelyeken keresztül a Xiaomi a saját MiMo modelljeinek felhasználói beszélgetéseit és kódolási munkameneteit az OpenClaw és OpenCode rendszereken keresztül Claude-nak továbbította, hogy gazdagítsa a jövőbeli modellek betanítási adatait. A GTG-16008 jelzésű esetben az Anthropic több mint 400 000 párbeszédet követett nyomon 2026 márciusában és áprilisában.

Háttér: mit tud a Claude díjmentes verziója

Forrás

Feldolgozott sajtóforrás·The Decoder

Eredeti cikk megnyitása →

Ez a cikk a fenti sajtóforrás alapján készült AI-összefoglalóval.

tetszett a cikk? oszd meg →
Megosztás

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom