ÉlőUtoljára: 4 perceMa: 14

Rovat · 63. oldal

Kutatás

AI research papers, arXiv publikációk, benchmarkok, tudományos áttörések

1332 cikk az archívumban

A kutatók 80%-kal javították a nagy nyelvi modellek teljesítményét
Kutatás

A kutatók 80%-kal javították a nagy nyelvi modellek teljesítményét

Kweku Yamoah és kutatócsoportja 8 277 tanulmányt elemezve finomhangolta az 1,2 milliárd paraméteres nyílt forráskódú nyelvi modellt, amely 80,79 %-kal jobb F1-pontszámot és 86,40 %-os egyezést ért el az emberi kódolóval, miközben a szisztematikus áttekintések szűrését jelentősen felgyorsította.

ArXiv NLP·AI
A kutatók modellje szerint a felhasználók bízhatnak az AI-fejlesztőkben, ha olcsó a monitoring
Kutatás

A kutatók modellje szerint a felhasználók bízhatnak az AI-fejlesztőkben, ha olcsó a monitoring

A 24 oldalas arXiv tanulmányban Adeela Bashir és 23 társa evolúciós játékelmélettel kimutatták, hogy a felhasználók bizalma az AI-fejlesztőkben csak akkor alakul ki, ha a monitoring költsége alacsony és a fejlesztőknek érdeke a biztonságos rendszerek létrehozása.

ArXiv AI·AI
Az AutoSAM 100%-os pontossággal generál input fájlokat a SAM kódhoz
Kutatás

Az AutoSAM 100%-os pontossággal generál input fájlokat a SAM kódhoz

A Texas A&M és az Argonne kutatói által kifejlesztett AutoSAM rendszer már a laboratóriumi tesztekben 100%-os pontossággal állít elő SAM kód input fájlokat, miközben PDF-ekből, ábrákból és táblázatokból automatikusan nyeri ki a szimulációs paramétereket.

ArXiv AI·AI
Az Opus 4.6 23,2%-os eredményt ér el a PostTrainBench teszten
Kutatás

Az Opus 4.6 23,2%-os eredményt ér el a PostTrainBench teszten

A PostTrainBench teszten az Opus 4.6 modell 23,2%-os pontosságot ért el, ami háromszor jobb, mint a többi vizsgált modell 7,5%-os átlaga, miközben a résztvevő modelleknek 10 óra állt rendelkezésükre egy H100 GPU-n.

Import AI·AI
A Google Gemma modellje összeomlik a visszautasítások során
Kutatás

A Google Gemma modellje összeomlik a visszautasítások során

Több mint 70%-ra ugrott a Gemma-27B modell frusztrációs szintje a 8.

Import AI·AI
A konzisztencia elfedi a torzítást: interjúkészítői hatások a depressziókimutatásban
Kutatás

A konzisztencia elfedi a torzítást: interjúkészítői hatások a depressziókimutatásban

Hat kutató, köztük Hasindri Watawana és Sergio Burdisso, azonosított egy szisztematikus torzítást az interjúkészítői promptokból az ANDROIDS, DAIC-WOZ és E-DAIC adathalmazokban.

ArXiv NLP·AI
A hálózati metszés hatékonysága a reprezentáció hierarchiájától függ
Kutatás

A hálózati metszés hatékonysága a reprezentáció hierarchiájától függ

Shwai He és munkatársai szerint a hálózati metszés hatékonysága a reprezentáció hierarchiájától függ, és az embedding és logit terek reprezentációi ellenállnak a metszés okozta zavaroknak.

ArXiv NLP·AI
A kollektív intelligencia néha puszta lottó: az LLM-ek memetikus sodródása
Kutatás

A kollektív intelligencia néha puszta lottó: az LLM-ek memetikus sodródása

Hidenori Tanaka 2026. március 25-én közzétett, 19 oldalas arXiv-es tanulmányában a Quantized Simplex Gossip (QSG) modell segítségével bizonyítja, hogy a többügynökös LLM-rendszerek kollektív intelligenciája gyakran puszta lottó, melyet a populáció mérete, sávszélesség és belső bizonytalanság befolyásol.

ArXiv AI·AI
Az ARC-AGI-3 teszt szerint az AI rendszerek csak 1%-os teljesítményt érnek el
Kutatás

Az ARC-AGI-3 teszt szerint az AI rendszerek csak 1%-os teljesítményt érnek el

Az ARC-AGI-3 egy új, interaktív benchmark, amely absztrakt, fordulós játékokban méri a folyékony adaptív hatékonyságot; a teszt szerint az emberek 100 %-os, míg a legjobb AI rendszerek mindössze 0,3 %-ot érnek el.

ArXiv AI·AI
Az állatjóléti mozgalom az AI-tól várja a megoldást
Kutatás

Az állatjóléti mozgalom az AI-tól várja a megoldást

Több mint 100 résztvevő gyűlt össze San Franciscóban, hogy megvitassák, hogyan lehet az AI-t bevonni az állatjóléti mozgalomba, Constance Li, a Sentient Futures alapítója szerint.

MIT Technology Review·AI
A gyakori maszturbáció javítja a spermiumok minőségét
Kutatás

A gyakori maszturbáció javítja a spermiumok minőségét

Egy új tanulmány a Proceedings of the Royal Society B folyóiratban megjelent, amely szerint a gyakori ejakuláció nemcsak a spermiumok minőségét javítja, hanem hozzájárul a termékenység fokozásához is.

404 Media·AI
A Microsoft elcsábítja az Allen Institute for AI csúcsgárdáját
Kutatás

A Microsoft elcsábítja az Allen Institute for AI csúcsgárdáját

Hanna Hajishirzi, a nyelvi modellek szakértője, 152 millió dolláros projektet vezetett az Nvidia-val és az NSF-fel.

The Decoder·AI
Az Axiom Math Axplorer eszköze 2,5 óra alatt oldja meg a Turán-problémát
Kutatás

Az Axiom Math Axplorer eszköze 2,5 óra alatt oldja meg a Turán-problémát

François Charton, az Axiom Math kutatója szerint a matematikai áttörések hatalmas hatással vannak a technológiára.

MIT Technology Review·AI
A családi irodák 86 százaléka használ AI-t pénzügyi adatok elemzésére
Kutatás

A családi irodák 86 százaléka használ AI-t pénzügyi adatok elemzésére

A családi irodák 86 százaléka használ AI-t, és összesen 119,37 milliárd dollár értékű vagyont képviselnek.

AI News·AI
Ypsilanti: 1,25 milliárd dolláros nukleáris datacenter vonzza az iráni drónok figyelmét
Kutatás

Ypsilanti: 1,25 milliárd dolláros nukleáris datacenter vonzza az iráni drónok figyelmét

A Ypsilanti város ügyvédje szerint a 1,25 milliárd dolláros, az University of Michigan és a Los Alamos National Laboratory által közösen épített nukleáris datacenter jelentős célponttá válik, mivel az iráni drónok korábban már kritikus infrastruktúrát támadtak a Közel-Keleten.

404 Media·AI
Google 1 millió dollárba fektet 50 000 szívvizsgálatot vidéki Ausztráliába
Kutatás

Google 1 millió dollárba fektet 50 000 szívvizsgálatot vidéki Ausztráliába

A Google Australia 1 millió dolláros Digital Future Initiative támogatásával indítja el a Population Health AI programot, amely a Google Earth AI és a Maps adatait felhasználva 50 000 szívvizsgálatot biztosít a vidéki Ausztráliában élő, 60 %-kal magasabb halálozási kockázatú lakosok számára.

Google AI Blog·AI
Karpathy: az emberi intuíció most a kutatási szűk kereszt
Kutatás

Karpathy: az emberi intuíció most a kutatási szűk kereszt

Andrej Karpathy, a Tesla AI vezetője szerint a GPT-2 kézi finomhangolását egy éjszakai autonóm ügynök felülmúlta, miközben olyan apró beállításokat is felfedezett, amelyeket ő maga nem vett észre. A kutatók most a mérhető metrikákra kell, hogy összpontosítsanak, hogy az intuíciótól való függőséget csökkentsék.

The Decoder·AI
Tudósok 45 sziklás bolygóra szűkítették a küldetést
Kutatás

Tudósok 45 sziklás bolygóra szűkítették a küldetést

A kutatók több mint hat ezer exobolygó közül 45-öt jelöltek ki, melyek a Föld kétszeresénél kisebb méretű sziklás világok, a lakható zóna belsejében keringenek, így felszíni folyékony víz lehetséges.

404 Media·AI
Az AI változtatja meg a jogászszakmát
Kutatás

Az AI változtatja meg a jogászszakmát

Az angliai jogász, Anthony Searle a ChatGPT-t alkalmazza a koronabírósági eljárásokban, hogy részletesebb kérdéseket tegyen fel a sebészeknek és pótolja a hiányzó szakértői véleményeket, miközben részt vesz az AI-governance stratégia kidolgozásában a londoni Serjeants' Inn keretében.

Ars Technica·AI
Az AI-ügynökök sikeréhez erős adatinfrastruktúra szükséges
Kutatás

Az AI-ügynökök sikeréhez erős adatinfrastruktúra szükséges

Az MIT Technology Review szerint a vállalatok többsége már kísérletezik AI-ügynökökkel, de az adatinfrastruktúra hiánya – különösen a kontextusban gazdag, üzleti adat-architektúra hiánya – akadályozza a skálázást, míg az SAP szerint a következő hónapokban kulcsfontosságú lesz a megfelelő adatfelépítés.

MIT Technology Review·AI
Hol bukkanhat fel az OpenAI technológiája Iránban
Kutatás

Hol bukkanhat fel az OpenAI technológiája Iránban

Két héttal ezelőtt az OpenAI a Pentagonnal kötött megállapodást, mely szerint AI-ját csak klaszterezett környezetben, önálló fegyverek vagy belföldi megfigyelés céljára nem használhatja a hadsereg, miközben technológiája már az Irán elleni konfliktusban is szerepet kaphat a célpontok azonosításában.

MIT Technology Review·AI

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom