Archívum
Április
2026
50 cikk a hónapban
- Kutatás
A Coefficient Giving 100 millió dollárt különít el bio biztonsági projektekre
LessWrong AI
- Kutatás
A SimMOF ellenőrzi a folyamatokat, és a természetes nyelvi lekérdezések alapján automatizálja az MOF szimulációkat
ArXiv AI
- Kutatás
A GISTBench bemutatja: 8 nyílt súlyú LLM felmérése felhasználói viselkedés alapján
ArXiv AI
- Kutatás
Az LLM-ek 6,5%-ban hallucinálnak, 13,2%-ban mulasztanak a válaszokban
ArXiv NLP
- Kutatás
LLM-Alapú Ügynökök: A Minőség Értékelése Logaritmikusan, Az Új Felfedezések Pedig Hatványtörvény Szerint Növekednek
ArXiv AI
- Kutatás
A kutatók felfedezték, hogyan reaktiválhatók a poszt-tréningelt LLM-ek elrejtett biztonsági mechanizmusai
ArXiv NLP
- Kutatás
Az új Connections játékban az AI-ügynököknek együttműködésre kell törekedniük
ArXiv AI
- Kutatás
Az OpenTools 6-22%-os teljesítménynövekedést ér el a downstream feladatokban
ArXiv AI
- Kutatás
A hibrid determinisztikus-LLM megközelítés 99%-os pontosságot ér el az információkivonásban
ArXiv NLP
- Kutatás
A Stanford egyetem ingyenes transzformátor kurzust indít holnap
Reddit LocalLLaMA
- Kutatás
Az LLM-ek megbízhatóak a kvalitatív kutatásokban, de az értékelésük még kérdéses
ArXiv NLP
- Kutatás
A ClauseCompose dekóder 95,7%-os pontosságot ér el ismeretlen szándékpárokon
ArXiv NLP
- Kutatás
Az AI Safety három módja, hogy elvonja a figyelmet
LessWrong AI
- Kutatás
A Midjourney képgenerátora szép képeket készít, de nem követi az utasításokat
Tech Xplore
- Kutatás
A Holocaust oral history elemzésében 107,305 megnyilatkozásra támaszkodnak
ArXiv NLP
- Kutatás
Az OpenAI modelljei 4 hónap alatt duplázódnak, a szakértők 2028-ra várják az Automated Coder megjelenését
LessWrong AI
- Kutatás
Federált ellenálló tanulás: az új módszer lehet a jövője a gépi tanulásnak
Reddit ML
- Kutatás
Nincs egyetlen szent könyv a gépi tanulásban
Reddit ML
- Kutatás
Az OpenAI bejelenti a Comprehensive Superhuman Intelligence-t, ami 72 órán belül átalakítja a Föld felszínét
LessWrong AI
- Kutatás
Az ArXiv új tanulmánya kategorikus keretet ad az AGI-architektúrák összehasonlítására
ArXiv AI
- Kutatás
A ChartDiff 8541 chartpárt tartalmaz, ami segíthet a több diagramos érvelésben
ArXiv AI
- Kutatás
Nvidia új keretrendszere: agentic scaffolding nélkül az AI-modellek megbuknak a robotvezérlésben
The Decoder
- Kutatás
Kvantum modellekben a klasszikus adatokat 5 lépésben dolgozzák fel
Towards Data Science
- Kutatás
Az OpenAI modellje 20%-kal pontosabban generál hipotéziseket a CrossTrace adathalmazzal
ArXiv NLP
- Kutatás
A Mimosa Framework 43,1%-os sikerarányt ér el a ScienceAgentBench teszten
ArXiv AI
- Kutatás
Az OpenAI modelljei 30%-kal pontosabban becslik a bizonytalanságot az új TAC módszerrel
ArXiv AI
- Kutatás
A Google AI-vezér szerint továbbra is érdemes megtanulni programozni
ZDNET
- Kutatás
A WAM modell 12 százalékponttal javítja a viselkedési klónozás sikerét
ArXiv AI
- Kutatás
Az EVOM keretrendszer 90%-os pontossággal oldja meg az optimalizálási feladatokat
ArXiv AI
- Kutatás
A biztonsági finomhangolás csökkenti az LLM-ek elmetulajdonítását, de nem rontja az empátiáját
ArXiv NLP
- Kutatás
A Google-kutatók felfedezték, hogy az LLM-ek több személyiséget szimulálnak a kérdések megválaszolásához
Import AI
- Kutatás
Az AI-projektek 65%-a munkabérre megy el
AI for Newsroom
- Kutatás
Az OptiMer 15-35-ször kevesebb számítási kapacitást igényel, mint a hagyományos adatkeverés
ArXiv NLP
- Kutatás
A Microsoft és az NVIDIA együttműködése 92%-kal csökkenti a nukleáris engedélyezési folyamatot
Azure Blog
- Kutatás
A Microsoft bevezeti az „The Shift” podcastot, 8 epizóddal az agentic AI-ről
Azure Blog
- Kutatás
Az Anthropic PBC megvalósította a valaha volt legnagyobb AI-kutatást
ThePrint
- Kutatás
A ChatGPT és a Grok LLM-ek terveznek adatbázist vírusok és tengeri mérgek elleni ellenszerekhez
ArXiv AI
- Kutatás
1500 videómintát tartalmaz az új SyriSign adathalmaz a szíriai arab jelnyelv fordításához
ArXiv NLP
- Kutatás
Az Emergence WebVoyager 95,9%-os egyetértést ért el az annotátorok között
ArXiv AI
- Kutatás
Az LLM-ek háromszor olyan gyakran vetnek be nukleáris fegyvert, mint az emberek
Import AI
- Kutatás
A nyelvi modellek emberi szemantikai ítéletekhez igazodnak a koncepció-képzésnek köszönhetően
ArXiv NLP
- Kutatás
5 ingyenes finomhangolást kínál egy vállalat a visszajelzésekért cserébe
Reddit ML
- Kutatás
Indul a HAISM: az ember-AI szimbiózis mozgalom
LessWrong AI
- Kutatás
Az APEX-EM keretrendszer forradalmasítja az autonóm ügynökök tanulását
ArXiv NLP
- Kutatás
Az AI-vége 1-4 év múlva érkezhet, éljük meg az utolsó éveket vidáman
LessWrong AI
- Kutatás
A YOLO csendben megbukik biztonságkritikus zárt körű osztályozásnál
Reddit ML
- Kutatás
Hat Models, Négy Feladat: Az LLM Alapú Szövegannotáció Rejtett Tényezői
ArXiv NLP
- Kutatás
A FormalProofBench 33,5%-os pontosságot ért el a diplomamunka-szintű matematikai bizonyításokban
ArXiv AI
- Kutatás
Hat LLM modell került tesztelésre 15 ország adataival
ArXiv NLP
- Kutatás
Az RL-képzés tönkreteszi a Chain-of-Thought monitorozhatóságot bizonyos esetekben
LessWrong AI