ÉlőUtoljára: 12 perceMa: 15
Modellek & LLMfrissítve: 14:15

Ötmilliárdos AI-modellt mutatott be a Reflection, Európában a Mistral erősít

Az AI-iparágban az elmúlt héten az új modellek bejelentése mellett milliárdos befektetések és kutatások zajlottak. A Reflection 501 milliárdos Beam modellje kevesebb számítással dolgozik, a Mistral pedig európai szuverenitásra építve indít új modellt.

Ötmilliárdos AI-modellt mutatott be a Reflection, Európában a Mistral erősít
Fotó: KOBU Agency / Unsplash
forrás: TheSequence·AI Forradalom szerk.·
Megosztás

A Reflection bemutatta a Beam nevű, kevert-szakértő (mixture-of-experts) architektúrájú modellt, amely 501 milliárd paraméterrel rendelkezik, ebből tokenenként 23 milliárd aktiválódik. A cég közlése szerint a modell versenyképes érvelési teljesítményt ér el, miközben lényegesen kevesebb becsült inferencia-számítást igényel, mint néhány nagyobb riválisa. A súlyok (weights) még ebben a hónapban várhatók, de a cég szerint az ügynököknek hosszú munkafolyamatokhoz intelligenciára van szükségük, működési költségvetéssel. (TheSequence)

Beam architektúra és inferencia-igény

A Reflection bemutatta a Beam nevű, kevert-szakértő (mixture-of-experts) architektúrájú modellt, amely 501 milliárd paraméterrel rendelkezik, ebből tokenenként 23 milliárd aktiválódik. A cég közlése szerint a modell versenyképes érvelési teljesítményt ér el, miközben lényegesen kevesebb becsült inferencia-számítást igényel, mint néhány nagyobb riválisa. A súlyok (weights) még ebben a hónapban várhatók, de a cég szerint az ügynököknek hosszú munkafolyamatokhoz intelligenciára van szükségük, működési költségvetéssel.

Mistral európai szuverenitása és az OpenAI kutatási eredményei

Európai válaszként a Mistral kiadta a Large 4 modellt, amelynek beceneve Le Chonk. A trillió paraméteres multimodális modell nyilvános API-előzetesben érhető el, a súlyok pedig a hónap végére várhatók. A Mistral elsősorban kódolásra, kiberbiztonságra, pénzügyekre és jogra fókuszál, európai infrastruktúrán futtatva. A cég szerint a szuverenitás egyre fontosabb termékjellemzővé válik, különösen az adatok feletti kontroll és a folyamatos hozzáférés szempontjából.

Az OpenAI alapvetőbb dimenziót adott a képhez: az intelligencia hozzájárulását a matematikai felfedezésekhez. A cég több mint 700 kéziratot tett közzé egy még ki nem adott modellből, amelyekben nyílt kutatási problémák megoldásáról számolnak be, és eredményeikhez Lean formalizálásokat is mellékeltek. Az ellenőrzés még nem fejeződött be, több kéziratot már javítottak vagy visszavontak. Az OpenAI szerint a modell képes lehet felgyorsítani a kutatást, ami az eredmények ellenőrzését, értelmezését és összekapcsolását teszi a fő szűk keresztmetszetté.

A TypeSafe 870 millió dolláros Series A finanszírozást szerzett 7,5 milliárd dolláros értékelés mellett. A cég Jev modellje típusbiztos döntéseket hoz, megbízhatósági becslésekkel, amelyeket a szoftverek közvetlenül fogyaszthatnak. Ez különösen az üzleti folyamatokban előforduló kis döntések, mint például kérések osztályozása vagy kivételek kezelése esetén lehet hasznos.

Az Arena 200 millió dolláros Series B kört zárt 3,1 milliárd dolláros értékelés mellett, és bevezette az Alignment Indexet, amely az illetéktelen cselekvéseket és a feladatok teljesítésének hamis állításait vizsgálja. Ez a képességek értékelésének fontos bővítése, mivel egy modell kiváló válaszokat adhat, de megbízhatatlan kolléga lehet.

A befektetők abban bíznak, hogy az intelligencia megítélésére szolgáló rendszerek értékes infrastruktúrává válhatnak. Az iparág a jelek szerint az intelligencia különböző gazdasági problémákra bontását végzi: a képesség előállítása, hatékony szállítása, a kontroll fenntartása és a viselkedés ellenőrzése. Ezek a problémák erősítik egymást: az olcsóbb inferencia több automatizálást tesz lehetővé, a nagyobb autonómia pedig elengedhetetlenné teszi az értékelést. Az OpenAI 700+ kéziratának ellenőrzése még tart, több eredményt javítottak vagy vontak vissza.

Forrás

Feldolgozott sajtóforrás·TheSequence

Eredeti cikk megnyitása →

Ez a cikk a fenti sajtóforrás alapján készült AI-összefoglalóval.

tetszett a cikk? oszd meg →
Megosztás

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

☕ Támogatom