Egy millió tokenes kontextusablakot nyújt az új DeepSeek-modell
A DeepSeek V4 Pro új modellje 1 millió tokenes kontextusablakot és 384 000 tokenes maximális kimeneti hosszt kínál, a Global Times szerint.

A kínai DeepSeek bemutatta legújabb AI-modelljét, a V4 Pro-t, amely jelentősen fejlettebb agente-képességekkel, valamint a Responses API és a Codex integrációjával rendelkezik. A kínai cég modellje a hírek szerint felveszi a versenyt az olyan vezető nemzetközi modellekkel, mint az Anthropic Claude Fable 5.
A V4 Pro modell már elérhető mobilalkalmazásokon, webes felületen és API-n keresztül, az „Expert Mode” kiválasztásával. A DeepSeek egy nappal korábban, szerdán frissítette API dokumentációját is, bevezetve a V4 Pro 0813 verzióját, amely a modell API-s változatának hivatalos bevezetését jelzi.
Fejlett agente-képességek és nagy kontextusablak
A DeepSeek szerint az új modell 1 millió tokenes kontextusablakot, maximum 384 000 tokenes kimeneti hosszt és támogatja a gondolkodó (thinking) és nem-gondolkodó (non-thinking) módokat is.
Ez a fejlesztés arra utal, hogy az AI-fejlesztők egyre inkább az egyszerű csevegési funkciókról a hosszabb, több lépésből álló munkafolyamatok felé tolódnak el, amelyek eszköztárak használatát, kódvégrehajtást és folyamatos feladatvégzést igényelnek. Ezek a munkafolyamatok jóval több tokent emésztenek fel, mint a hagyományos beszélgetési alkalmazások, így az árazás és a működési hatékonyság kulcsfontosságúvá válik.
Versenyképes teljesítményteszt eredmények
A DeepSeek teljesítményteszt-teszteket is közzétett, amelyek erős teljesítményt mutatnak több agente-központú feladatban, beleértve a terminálműveleteket, kódfejlesztést, eszköztárak használatát és biztonsági feladatokat. A cég közlése szerint a V4 Pro 0813 bizonyos esetekben megközelítette vagy túl is szárnyalta a vezető tengerentúli modellek teljesítményét. A DeepSeek V4 Pro 0813 a Terminal-Bench teszten 87,9 pontot ért el, ami megközelíti az Anthropic Claude Fable 5 88 pontos eredményét.
Árazás és piaci pozíció
A DeepSeek V4 Pro 0813 árazása is figyelemfelkeltő: 3 jüan (körülbelül 0,44 dollár) per millió bemeneti token és 6 jüan per millió kimeneti token, míg a gyorsítótárazott bemenet ára 0,025 jüan per millió token. A SemiAnalysis kutatócég szerint a modell „jelentősen veri a Nemotron 3 Ultrát agente-feladatokon”. Az xAI Grok 4.6 modellje, amely szintén hosszú távú ügynökökre és vizuális munkára készült, 2 dollár per millió bemeneti és 6 dollár per millió kimeneti token áron érhető el.
A DeepSeek V4 Pro 0813 és a Grok 4.6 közel egyidejű megjelenése azt mutatja, hogy az AI-ipar egy új versenyszakaszba lépett. A határvonalat jelentő modelleket már nem csak a paraméterek skálája vagy a beszélgetési képesség határozza meg, hanem egyre inkább az AI-rendszerek azon képessége, hogy önállóan használjanak eszközöket, írjanak és hajtsanak végre kódot, valamint több lépésből álló feladatokat végezzenek el – mondta Tian Feng, a SenseTime Intelligens Iparági Kutatóintézetének volt dékánja a Global Timesnak.
A DeepSeek jelezte, hogy az API árak emelését tervezi, de a pontos időzítésről és mértékről nem közölt részleteket. Elemzők szerint a cég végül egy részletesebb árazási struktúrát fogadhat el, hogy egyensúlyt teremtsen a növekvő működési költségek és a kereskedelmi bevételek között. A DeepSeek árai továbbra is rendkívül versenyképesek a határvonalat jelentő modellek között, különösen az agente- és kódolási munkaterheltek esetében, amelyek gyakran nagy tokenfogyasztást igényelnek.