ÉlőUtoljára: 16 perceMa: 9

Rovat

Kutatás

AI research papers, arXiv publikációk, benchmarkok, tudományos áttörések

1331 cikk az archívumban

Klinikai kérdésekre válaszol az UIC-AIHealth4All, 3. hely a bizonyítékazonosításban
Kutatás

Klinikai kérdésekre válaszol az UIC-AIHealth4All, 3. hely a bizonyítékazonosításban

Az UIC-AIHealth4All rendszere 3. lett az ArchEHR-QA 2026 versenyen a bizonyítékazonosításban, 62,90-es Strict Micro F1-pontszámmal. Az answer-first folyamat-t használó modell kimenetei azonban átlagosan 3,2 olvasási fokkal nehezebbek a klinikusok által írt referenciáknál.

ArXiv NLP·AI
Az emberközpontú AI-magyarázatokhoz információkeresési pszichológiát javasolnak
Kutatás

Az emberközpontú AI-magyarázatokhoz információkeresési pszichológiát javasolnak

Az emberközpontú AI-magyarázatok (HCXAI) tervezésekor figyelembe kell venni az információkeresés pszichológiáját, mivel a felhasználók instrumentális, hedón és kognitív hasznosság alapján döntenek a magyarázatok elfogadásáról.

ArXiv AI·AI
Belső jeleiből megtudható, hiányos-e az információ, egy új kutatás szerint
Kutatás

Belső jeleiből megtudható, hiányos-e az információ, egy új kutatás szerint

A nyelvmodellek képesek felismerni, ha a RAG-rendszer által kapott információ nem elegendő vagy ellentmondásos a válaszadáshoz — derül ki egy új, 16 különböző modellre kiterjedő kutatásból.

ArXiv NLP·AI
Új valós idejű hangügynök-teljesítménytesztet jelentett az Artificial Analysis
Kutatás

Új valós idejű hangügynök-teljesítménytesztet jelentett az Artificial Analysis

A valós idejű hangügynökök sebességét leggyakrabban a TTFT (Time-to-First-Token) alapján választják, ám ez a mérőszám félrevezető lehet. A tényleges felhasználói élményt a TTFS (Time-to-First-Sentence) határozza meg, amelynek ideális esetben 800 ms a célja.

MarkTechPost·AI
AI szinte minden egyetemi feladatot megold, állítja az MIT-jelentés
Kutatás

AI szinte minden egyetemi feladatot megold, állítja az MIT-jelentés

Az MIT szerint az AI szinte minden egyetemi írásbeli feladatot képes megoldani, ami campus-kultúraváltást idézett elő. Az EU AI Act szigorúbb szabályokat vezet be a diákfelügyeletre.

TNW·AI
Az AI-val kapcsolatos munkavállalói elégedettség 81 százalékról 43 százalékra zuhant
Kutatás

Az AI-val kapcsolatos munkavállalói elégedettség 81 százalékról 43 százalékra zuhant

Az AI-val kapcsolatos amerikai munkavállalói vélemények 81%-ról 43%-ra estek vissza 2019 és 2026 között, miközben a negatív kommentek aránya 53%-ra nőtt – derül ki a Glassdoor elemzéséből.

The Decoder·AI
Elütések és OCR-hibák miatt romlik a RAG-eredmény, az embeddings oldja meg a problémát
Kutatás

Elütések és OCR-hibák miatt romlik a RAG-eredmény, az embeddings oldja meg a problémát

A felhasználói gépelési hibák, transzkripciós és OCR-zajok rontják a RAG-rendszerek teljesítményét. A klasszikus helyesírás-ellenőrzők csak az elsőt tudják javítani.

Towards Data Science·AI
Az embodied AI új matematikát igényel a fizikai korlátok miatt
Kutatás

Az embodied AI új matematikát igényel a fizikai korlátok miatt

Az embodied AI rendszerek fejlődését a fizikai korlátok, mint az energiaigény, súly és késleltetés szabják meg, nem a szoftveres tervezés. Zhengis Tileubay szerint új matematikai megközelítésekre van szükség.

The Robot Report·AI
A RAG helyett hat olcsóbb alternatívát javasolnak a kutatók
Kutatás

A RAG helyett hat olcsóbb alternatívát javasolnak a kutatók

Angela Shi és Kezhan Shi szerint a pontos egyezés, a helyesírás-javítás vagy a kulcsszó-keresés alkalmazása nemcsak gyorsabb, hanem átláthatóbb is, mivel ezek a módszerek milliszekundumok alatt adnak választ, és megnevezik a működésük mögött álló szabályt.

Towards Data Science·AI
GPT-4o közel egy ponttal emeli a hallgatók jegyét a Bocconi üzleti feladatában
Kutatás

GPT-4o közel egy ponttal emeli a hallgatók jegyét a Bocconi üzleti feladatában

Több mint ezer friss egyetemi hallgató részt vett a kísérletben, amelyben a GPT-4o használata közel egy ponttal növelte az átlagos értékelést egy ötpontos skálán.

The Decoder·AI
Valós videókból futtatható fizikai szimulációkat generál a MirroS új AI-ja
Kutatás

Valós videókból futtatható fizikai szimulációkat generál a MirroS új AI-ja

A Code-as-World-VL-9B modell 55,4 MRA-t ért el a QuantiPhy-teszten, megelőzve a Gemini-3.1 Flash-t (54,8) és a legerősebb nyílt forráskódú alapmodellt.

MarkTechPost·AI
10 ezer ingyenes Claude-előfizetést ad a kutatóknak az Anthropic
Kutatás

10 ezer ingyenes Claude-előfizetést ad a kutatóknak az Anthropic

Az Anthropic 10 ezer ingyenes vagy kedvezményes Claude-előfizetést kínál tudósoknak egy évre új csapatcsomagjában, miközben bővíti AI for Science programját is.

Anthropic·AI
A Meta visszatért az AI-frontra, de vajon a csúcson is marad?
Kutatás

A Meta visszatért az AI-frontra, de vajon a csúcson is marad?

A Meta lenyűgöző sebességgel zárkózott fel az AI-élvonalhoz, de vajon a 'Watermelon' modell és a 'Hatch' termék elég lesz-e a felhasználók megnyeréséhez?

spyglass.org·AI
Tízmillió órás videóadatbázist ad ki kutatóknak az LAION
Kutatás

Tízmillió órás videóadatbázist ad ki kutatóknak az LAION

A LAION kiadta a Big Video adathalmaz (BVD) nevű, 80 millió videóból álló, 10 millió óra anyagot tartalmazó nyílt adathalmazát, amelyet nem kereskedelmi AI-kutatási célokra lehet felhasználni.

The Decoder·AI
Nem követik a Bayes-szabályt az LLM-ek, új Stanford-módszerrel mérték
Kutatás

Nem követik a Bayes-szabályt az LLM-ek, új Stanford-módszerrel mérték

A Stanford kutatói által az EMNLP 2026-on bemutatott új metrika szerint az LLM-ek nem követik következetesen a Bayes-szabályokat, ami a világmodelljeik hibás voltát jelzi.

Apple ML·AI
Kísérleteket tervez és cikkeket ír az új Google Deepmind AI
Kutatás

Kísérleteket tervez és cikkeket ír az új Google Deepmind AI

A Google Deepmind Co-Scientist AI-rendszere már nem csak hipotéziseket generál, hanem teljes kutatókörfolyamatot végez: kísérleteket tervez, vezérli a laborberendezéseket és tudományos cikkeket ír, miközben a hibás adatközlés aránya 4 százalékra csökkent.

The Decoder·AI
Igazságosabbá teszi az AI-modelleket az Anthropic automatizált rendszere
Kutatás

Igazságosabbá teszi az AI-modelleket az Anthropic automatizált rendszere

Az Anthropic kutatói bemutatták, hogyan képesek automatizált rendszerek emberi beavatkozás nélkül javítani a mesterséges intelligencia modellek igazságosságát 10 különböző teszten, miközben teljesítményük nem csökken.

TechCrunch·AI
Már elérte az AGI-t az Nvidia, de értelmetlennek tartja a mérföldkövet Jensen Huang
Kutatás

Már elérte az AGI-t az Nvidia, de értelmetlennek tartja a mérföldkövet Jensen Huang

Jensen Huang szerdai eredménybeszámolóján jelentette be, hogy az Nvidia elérte az AGI-t, az AI-iparág egyik végső célját. Ugyanakkor szinte azonnal hozzátette, hogy a kitüntetett mérföldkő „értelmetlen”.

The Verge·AI
Világelső dupla vak AI-értékelést indít a Google a Gemini Lite-tal
Kutatás

Világelső dupla vak AI-értékelést indít a Google a Gemini Lite-tal

A Google a szingapúri AI Safety Institute, az OpenMined, az AVERI és a MLCommons partnerekkel kriptográfiailag biztonságos környezetben teszteli a Gemini Flash Lite modellt, hogy megakadályozza a teljesítményteszt-szennyeződést.

Google DeepMind·AI
Jobb dolgozatokat írnak a diákok, ha kombinálják a ChatGPT-t a kritikai gondolkodással
Kutatás

Jobb dolgozatokat írnak a diákok, ha kombinálják a ChatGPT-t a kritikai gondolkodással

A Bocconi Egyetem és az OpenAI közös kutatása szerint a ChatGPT-hozzáférés javította a diákok munkáinak minőségét és koherenciáját, míg a kritikai gondolkodás képzése több egyedi ötletet eredményezett.

OpenAI·AI
Új AI-módszert javasol az időjárás és a fúzió modellezésére a Caltech kutatója
Kutatás

Új AI-módszert javasol az időjárás és a fúzió modellezésére a Caltech kutatója

Anima Anandkumar, a Caltech professzora szerint az AI-modellek nem alkalmasak a fizikai világ (időjárás, fúzió) modellezésére, mert más megközelítést igényelnek, mint a nyelvi modellek. A Neural Operators és a FourCastNet 3 azonban áttörést hozhat.

Latent Space·AI

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom