Archívum
Május
2026
50 cikk a hónapban
50
27
- Kutatás
Utazási márkák láthatósága: Új index rangsorolja a légitársaságokat és szállodákat az AI-ban
Cision PR Newswire
- Kutatás
Új AI-rendszer segíti a robotok együttműködését városi környezetben
ArXiv CV
- Kutatás
A LongAV-Compass 284 tesztesetet tartalmaz az audio-vizuális generáció értékeléséhez
ArXiv CV
- Kutatás
Filozófusokat alkalmaz az OpenAI és a Google
Wired
- Kutatás
Új keretrendszer 300 szituációval térképezi az LLM-ek kulturális értékeit
ArXiv NLP
- Kutatás
LLM-ek hallucinációi most már könnyebben kiszűrhetők a FEPoID-vel
ArXiv AI
- Kutatás
GEM új adatkeverési módszerrel 1,1B paraméteres modellek teljesítményét javítja
ArXiv ML
- Kutatás
GPT-5 mini a legjobb eredményt érte el az új 1 400 fordulós teljesítményteszten
ArXiv NLP
26
25
- Kutatás
Agentic AI: 3 határstratégiát definiál
ArXiv AI
- Kutatás
Az A-LEMS öt rétegű folyamat-jával mérik az energiafelhasználást célonként
ArXiv AI
- Kutatás
A Deterministic Horizon 19-31 közötti értékkel határozza meg a pontosság plafont
ArXiv AI
- Kutatás
Gemini 2.5 Flash 21,13%-os hibával felülmúlja a GPT modelleket Slack-tudásbecslésben
ArXiv NLP
24
23
- Kutatás
Linear probera épülő elnyomás felfedi a döntési határt
ArXiv AI
- Kutatás
DivSkill-SQL +11,1 ponttal növeli a Snowflake SQL pontosságot
ArXiv NLP
- Kutatás
TO-Agents két feladatban hoz hierarchikus ágstruktúrákat a tervezőknek
ArXiv AI
- Kutatás
Davinder Singh: 100 millió bit
Towards Data Science
- Kutatás
Túlzott AI-használat gyengítheti a logikai érvelést, mutatja egy új kutatás
ArXiv AI
- Kutatás
Hatékonyabb gépi felejtést hoz az LLM-ekbe a DualOptim+ rendszer
ArXiv ML
- Kutatás
8B-paraméteres modellek verik a GPT-5-öt az ötlet-előrejelzésben: 77,1% pontosság
ArXiv ML
22
- Kutatás
3-5-szörös gyorsulást hoz a szekvenciagenerálásban az új neurális módszer
ArXiv ML
- Kutatás
Két fázisban tanul a diffúziós modell a zajszint szerint
ArXiv ML
- Kutatás
GROW-módszerrel gyorsítja a VLM-ügynökök nyílt világú feladatmegoldását az ArXiv
ArXiv ML
- Kutatás
Új benchmarkkal méri az Apple a streamelt vizuális asszisztensek valós idejű teljesítményét
Apple ML
- Kutatás
A Decentraland közösségi hangulata előre jelezheti a kriptovaluta-árfolyamot
ArXiv NLP
- Kutatás
Sem-Detect: Az AI-generált szakértői véleményeket is leleplezi az új módszer
ArXiv NLP
- Kutatás
AI ügynök publikált iOS appot az Apple Store-ba, új értékelési módszerrel tesztelve
ArXiv AI
- Kutatás
Valósághűbb gyalogos-szimulációval javulhat az önvezető autók biztonsága
ArXiv ML
- Kutatás
Öntanuló képgeneráló ügynök fejlődik vizuális visszajelzésekkel a GenEvolve-ban
ArXiv CV
- Kutatás
AI-ügynökökkel mérhető a tárgyalási siker: új módszert mutat be az ArXiv
ArXiv AI
- Kutatás
Új embedding-módszerrel gyorsítja a logikai következtetést a Horn-logikában az ArXiv-tanulmány
ArXiv AI
- Kutatás
Generatív AI-val tennék elérhetőbbé a közlekedésbiztonsági adatokat a kutatók
ArXiv NLP
- Kutatás
Két nagyságrenddel gyorsítja a képleírások értékelését a BEiTScore
ArXiv CV
- Kutatás
31%-kal több MRI-adatot tesz elemezhetővé egy új AI-modell
ArXiv CV
- Kutatás
LLM-ek előzik a finomhangolt modelleket az öngyilkossági adatok elemzésében
ArXiv NLP
21
- Kutatás
99%-kal csökkenti az AI modellek skálázási költségét a Stanford új módszere
Stanford HAI
- Kutatás
WildRoadBench: Drónfelvételekkel teszteli az AI-t az úthibák felismerésében
ArXiv CV
- Kutatás
Maori szövegfelolvasó modellt fejlesztettek Új-Zélandon, a közösségé a tulajdonjog
IEEE Spectrum AI
- Kutatás
Feltételes optimizmussal fogadják az AI-t a nyelvi hozzáférés menedzserek
ArXiv NLP
- Kutatás
55% alatt teljesítenek a bíróként használt LLM-ek, megbízhatatlan az értékelésük
ArXiv NLP
- Kutatás
Minden komoly AI-ügynöknek saját számítógép kell a The Sequence szerint
TheSequence
- Kutatás
ANNEAL: öngyógyító AI-ügynök javítja a hibás folyamatismeretet
ArXiv AI
- Kutatás
Mirage: Akár 15,4 ponttal is felülmúlja a felejtési teszteket az új audit keretrendszer
ArXiv CV
- Kutatás
Új AI rendszer forradalmasítja az ökológiai megfigyelést, kevesebb energiát fogyaszt
ArXiv AI
- Kutatás
Webes AI-ügynökök sebességét növeli a Skim spekulatív végrehajtási rendszer
ArXiv AI
- Kutatás
Emberibb párbeszédeket ígér a Moshi modell: valós idejű szinkronizációt mértek
ArXiv NLP
- Kutatás
A Graph Transductive Sharpening javítja a csomópont-osztályozást címkézetlen adatokkal
ArXiv ML