Az xAI bemutatta a Grok 4.6-ot és a Grok Botot, amely bejelentkezve dolgozik
Az xAI új Grok 4.6 modellje a világ második legjobb tudásmunkában, de a legköltséghatékonyabb — állítja a cég, miközben bemutatta a Grok Botot, amely már eszközökbe jelentkezve végez el feladatokat.

Az xAI bemutatta a Grok 4.6 modellt és a Grok Bot nevű új AI-csapattagot, amely korai bétaverzióban érhető el. A Grok Bot képes bejelentkezni a felhasználó eszközeibe, azokat a felhasználóhoz hasonlóan használni, és befejezett munkával visszatérni. A technológia mögött a Grok 4.6 modell áll, amelyet a cég szerint a világ második legjobb tudásmunkára optimalizált modelljének tartanak, ugyanakkor kiemelkedik költséghatékonyságával. (Latent Space)
Grok 4.6: Sebesség és hatékonyság
A Grok 4.6 modell jelentős előrelépést mutat az AA-Briefcase ügynöki tudásmunka teljesítményteszten, miközben lényegesen olcsóbb a többi vezető modellnél — közölte az Artificial Analysis. Ez a modell egy 1,5 billió paraméteres egység, amely a Grok 4.5-re épít, különös hangsúlyt fektetve a hosszú távú ügynöki feladatokra, valamint az interaktív és vizuális munkára. A képzési folyamat során hosszabb kiegészítő betanítást, kurált, modell által generált adatokat a következtetéshez, valamint kiváló minőségű mérnöki adatokat és egy továbbfejlesztett optimalizálót alkalmaztak.
Ügynöki képességek és képzés
A Grok 4.6 modellt széles körű ügynöki RL-feladatokon képezték, beleértve a tudásmunkát, az általános kódolást, valamint speciális területeket, mint a kerneloptimalizálás, webfejlesztés és számítógépes tervezés (CAD). A cég szerint a modell önmagát tesztelő viselkedést mutatott hosszabb feladatok során. A fejlesztők a Grok 4.5-ös verziót használták az SFT-folyamatok újragenerálásához, beleértve az STEM, szoftverfejlesztés és tudásmunka területeit. A hibás nyomok kiszűrésére modellalapú ellenőrzéseket alkalmaztak.
Árazás és piaci pozíció
Az xAI a Grok 4.6 modellt 2, illetve 6 dolláros áron kínálja per 1 millió bemeneti és kimeneti token után, ami lényegesen alacsonyabb a versenytársakénál. A szakértők a modellt a kódolási és hibakeresési feladatok új alapértelmezettjeként említik. Független értékelések, mint az Artificial Analysis által végzett Intelligence Indexen, a Grok 4.6-ot a 61. helyre sorolják, ami nagyjából a GPT-5.6 Sol Max szintjének felel meg. A Terminal-Bench v2.1-en 88,4%-os, a GDPval-AA v2-n pedig 1753 Elo-s eredményt ért el.
Verseny a modellpiacon
A Grok 4.6 megjelenése a mesterséges intelligencia modellpiacának élvonalában történik, ahol olyan modellekkel versenyez, mint a GPT-5.6 Sol Max és a Claude Opus/Fable. Az xAI szerint a Grok 4.6 jelentős előrelépést tett az AA-Briefcase teszten, miközben ára jóval kedvezőbb. A Code Arena korai adatai szerint a modell a webfejlesztési feladatokban is versenyképes a GPT-5.6 Sol és a Claude Fable mellett. Elon Musk már jelezte, hogy a Grok 4.7 fejlesztése is folyamatban van.
További fejlesztések és nyílt forráskódú modellek
A piacon más jelentős fejlesztések is történtek: az Alibaba Qwen3.8-Max nyílt súlyokat kapott, míg a DeepSeek V4 Pro GA árazásával tűnt ki. A Microsoft bemutatta MAI-Thinking-1 nevű, saját fejlesztésű érvelési modelljét. Az Upstage Solar Pro 4 is előrelépett az Intelligence Indexen, különösen az ügynöki és hosszú kontextusú feladatokban.