ÉlőUtoljára: 4 perceMa: 12
Modellek & LLMfrissítve: 09:18

Az xAI bemutatta a Grok 4.6-ot és a Grok Botot, amely bejelentkezve dolgozik

Az xAI új Grok 4.6 modellje a világ második legjobb tudásmunkában, de a legköltséghatékonyabb — állítja a cég, miközben bemutatta a Grok Botot, amely már eszközökbe jelentkezve végez el feladatokat.

Az xAI bemutatta a Grok 4.6-ot és a Grok Botot, amely bejelentkezve dolgozik
Fotó: Mariia Shalabaieva / Unsplash
forrás: Latent Space·AI Forradalom szerk.·
Megosztás

Az xAI bemutatta a Grok 4.6 modellt és a Grok Bot nevű új AI-csapattagot, amely korai bétaverzióban érhető el. A Grok Bot képes bejelentkezni a felhasználó eszközeibe, azokat a felhasználóhoz hasonlóan használni, és befejezett munkával visszatérni. A technológia mögött a Grok 4.6 modell áll, amelyet a cég szerint a világ második legjobb tudásmunkára optimalizált modelljének tartanak, ugyanakkor kiemelkedik költséghatékonyságával. (Latent Space)

Grok 4.6: Sebesség és hatékonyság

A Grok 4.6 modell jelentős előrelépést mutat az AA-Briefcase ügynöki tudásmunka teljesítményteszten, miközben lényegesen olcsóbb a többi vezető modellnél — közölte az Artificial Analysis. Ez a modell egy 1,5 billió paraméteres egység, amely a Grok 4.5-re épít, különös hangsúlyt fektetve a hosszú távú ügynöki feladatokra, valamint az interaktív és vizuális munkára. A képzési folyamat során hosszabb kiegészítő betanítást, kurált, modell által generált adatokat a következtetéshez, valamint kiváló minőségű mérnöki adatokat és egy továbbfejlesztett optimalizálót alkalmaztak.

Ügynöki képességek és képzés

A Grok 4.6 modellt széles körű ügynöki RL-feladatokon képezték, beleértve a tudásmunkát, az általános kódolást, valamint speciális területeket, mint a kerneloptimalizálás, webfejlesztés és számítógépes tervezés (CAD). A cég szerint a modell önmagát tesztelő viselkedést mutatott hosszabb feladatok során. A fejlesztők a Grok 4.5-ös verziót használták az SFT-folyamatok újragenerálásához, beleértve az STEM, szoftverfejlesztés és tudásmunka területeit. A hibás nyomok kiszűrésére modellalapú ellenőrzéseket alkalmaztak.

Árazás és piaci pozíció

Az xAI a Grok 4.6 modellt 2, illetve 6 dolláros áron kínálja per 1 millió bemeneti és kimeneti token után, ami lényegesen alacsonyabb a versenytársakénál. A szakértők a modellt a kódolási és hibakeresési feladatok új alapértelmezettjeként említik. Független értékelések, mint az Artificial Analysis által végzett Intelligence Indexen, a Grok 4.6-ot a 61. helyre sorolják, ami nagyjából a GPT-5.6 Sol Max szintjének felel meg. A Terminal-Bench v2.1-en 88,4%-os, a GDPval-AA v2-n pedig 1753 Elo-s eredményt ért el.

Verseny a modellpiacon

A Grok 4.6 megjelenése a mesterséges intelligencia modellpiacának élvonalában történik, ahol olyan modellekkel versenyez, mint a GPT-5.6 Sol Max és a Claude Opus/Fable. Az xAI szerint a Grok 4.6 jelentős előrelépést tett az AA-Briefcase teszten, miközben ára jóval kedvezőbb. A Code Arena korai adatai szerint a modell a webfejlesztési feladatokban is versenyképes a GPT-5.6 Sol és a Claude Fable mellett. Elon Musk már jelezte, hogy a Grok 4.7 fejlesztése is folyamatban van.

További fejlesztések és nyílt forráskódú modellek

A piacon más jelentős fejlesztések is történtek: az Alibaba Qwen3.8-Max nyílt súlyokat kapott, míg a DeepSeek V4 Pro GA árazásával tűnt ki. A Microsoft bemutatta MAI-Thinking-1 nevű, saját fejlesztésű érvelési modelljét. Az Upstage Solar Pro 4 is előrelépett az Intelligence Indexen, különösen az ügynöki és hosszú kontextusú feladatokban.

Forrás

Feldolgozott sajtóforrás·Latent Space

Eredeti cikk megnyitása →

Ez a cikk a fenti sajtóforrás alapján készült AI-összefoglalóval.

tetszett a cikk? oszd meg →
Megosztás

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom