ÉlőUtoljára: 3 perceMa: 16
Modellek & LLMfrissítve: 14:16

Az Anthropic belsőleg használja a Claude-ot is túlszárnyaló Model 2-t

A fejlesztés a Mythos osztályba tartozik, és bár összességében erősebb a Claude Mythos 5-nél, bizonyos területeken még gyengébb teljesítményt nyújt.

Az Anthropic belsőleg használja a Claude-ot is túlszárnyaló Model 2-t
Fotó: Zach M / Unsplash
forrás: The Decoder·AI Forradalom szerk.·
Megosztás

Az Opus 4.6-ról a Mythosra való ugráshoz hasonló jelentős képességbeli ugrást nem mutat az új rendszer. Az Anthropic belső képességindexén, az AECI-n a Model 2 körülbelül 1,5 ponttal előzi meg a Mythos 5-öt. Ez a növekedés kisebb, mint a Mythos Preview és a Mythos 5 közötti különbség. (The Decoder)

Belső alkalmazás és tesztelés

Belső használatra a cég erősen támaszkodik a modellre kódolás, adatgenerálás, valamint kutatás és fejlesztés terén, néha folyamatosan futó ügynökökön keresztül. A Claude írja jelenleg a legtöbb kódot az Anthropic termelési rendszereiben. A Model 2 bevezetése előtt belső felülvizsgálaton esett át, de nem tesztelték olyan alaposan, mint a Mythos 5-öt.

Kockázatelemzés és jövőbeli tervek

Az Anthropic nem talált új vagy aggasztóbb elhajlásokat a folyamat során. A cég szerint az elhajlásból eredő kockázat „alacsony”. Jelenleg nincsenek tervek a modell külső kiadására.

Forrás

Feldolgozott sajtóforrás·The Decoder

Eredeti cikk megnyitása →

Ez a cikk a fenti sajtóforrás alapján készült AI-összefoglalóval.

tetszett a cikk? oszd meg →
Megosztás

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom