Archívum
Április
2026
22 cikk a hónapban
- Kutatás
Az ellenőrzés néha árt: Tanulási modell visszajelzések aszimmetrikus hatásai
ArXiv AI
- Kutatás
A LIMBO kutatócsoport 2024-es alapítása óta fejleszti az anthropikus következtetés matematikai keretrendszerét
LessWrong AI
- Kutatás
Az LLM-ek nem tudnak megbízható magyarázatot adni az AI-felelősséghez
AI for Newsroom
- Kutatás
Az AlpsBench bemutatja az első valós párbeszéden alapuló LLM személyre szabási teljesítménytesztet
ArXiv NLP
- Kutatás
A Mistral AI szerint az AI-modell testreszabása architektúrális követelmény
MIT Technology Review
- Kutatás
Kontrollos kísérlet: 3,2%-kal jobb eredményt ér el az LLM újraparaméterezése a szakcikkekhez való hozzáféréssel
Reddit ML
- Kutatás
A Google TurboQuantja 6-szor kevesebb memóriát használ, 8-szor gyorsabb és nulla pontosságveszteséggel
Reddit LocalLLaMA
- Kutatás
A bizonytalanság fontossága: új felmérés az UAXAI-ről
ArXiv AI
- Kutatás
A PentaNet projekt új lehetőségeket nyit a BitNet-en túl
Reddit ML
- Kutatás
Az inference sokkal gyorsabb Linuxon, mint Windowson
Reddit LocalLLaMA
- Kutatás
LLM-ek nem gondolkodnak, hanem utánoznak, egy újságíró tapasztalatai Claude-dal
AI for Newsroom
- Kutatás
Lebontva: így néz ki belülről a Claude Code, 500+ fájl, 40+ eszköz, 11 lépéses loop
Hacker News
- Kutatás
Miért nem lehet a TurboQuant-ot kvantálásra alkalmazni? A LocalLLaMA közösség magyarázza
Reddit LocalLLaMA
- Kutatás
Új teszt: az LLM-ek következetesen félreolvassák a feladatot, ha az instrukció és a szöveg ellentmond egymásnak
ArXiv NLP
- Kutatás
Az SciVisAgentBench teszt 108 esettanulmányt tartalmaz a tudományos adatelemzés és visualizáció értékelésére
ArXiv AI
- Kutatás
Egy kutatópáros szerint az AI valódi áttörése nem egyéni modellektől, hanem együttműködéstől várható
ArXiv AI
- Kutatás
Felfedezték az AI-ügynökök spontán szocializációját
ArXiv AI
- Kutatás
Az NVIDIA egy nap alatt képes domain-specifikus embedding modellt képezni
Hugging Face
- Kutatás
A Hugging Face nyílt forráskódú AI-ökoszisztémája 13 millió felhasználót számlál
Hugging Face
- Kutatás
A Meta új technikája 93%-ra növeli az LLM-ek kódellenőrzési pontosságát
VentureBeat
- Kutatás
Az OpenAI eszközei hónapok alatt váltak használhatóvá az nyílt forráskódú fejlesztőknek
ZDNet AI
- Kutatás
A TurboQuant technika nagy részben kompenzálja a Q8_0 kv quantizálás csökkentését
Reddit LocalLLaMA
Március
2026
28 cikk a hónapban
- Kutatás
Egy fejlesztő létrehozott egy autonóm ML ügynököt, ami végeláthatatlanul futtat kísérleteket tabuláris adatokon
Reddit ML
- Kutatás
Betekintés a transformer rétegekbe: így dolgoznak az inference motormeghajtások
Reddit LocalLLaMA
- Kutatás
Egy 9 soros seed és 5 kör kontrasztív visszajelzés felülmúlja az Optunát 96%-ban
Reddit ML
- Kutatás
Sűrűség-érzékeny kontextus-kompresszió új módszerrel
ArXiv NLP
- Kutatás
Kutatók kimutatták, hogy az összeesküvés-elméletek nem uniformán fejlődnek
ArXiv NLP
- Kutatás
A Lens Academy alapítója keresi társát, már vannak felhasználók és finanszírozás
LessWrong AI
- Kutatás
Az AutoB2G keretrendszer természetes nyelvi leírások alapján automatizálja az épület-hálózat szimulációt
ArXiv AI
- Kutatás
A RASPRef keretrendszer fejleszti a promptokat emberi felügyelet nélkül
ArXiv NLP
- Kutatás
Az utolsó ujjlenyomat: hogyan formálja a markdown az LLM szövegét
ArXiv NLP
- Kutatás
Az OpenAI és a Google fejleszti a nyelvi modellek szabályozhatóságát
Reddit ML
- Kutatás
PyTorch DDP-vel építsünk gyártásra képes, több csomópontos tanulási folyamatot
Towards Data Science
- Kutatás
A robotok is megtanulhatják a statisztikai csalást
Towards Data Science
- Kutatás
A LocalLLaMA 2026 modellje már jobb lehet a GPT-3.5-nél
Reddit LocalLLaMA
- Kutatás
A LessWrong kutatói felfedezik: az LLM-ekben az elhitetés hathatós eszköz az irányításban
LessWrong AI
- Kutatás
Irán nyerésre áll az AI-propagandaháborúban
404 Media
- Kutatás
Georgi Gerganov szerint a helyi modellekben rengeteg apró hibától szenvednek
Simon Willison
- Kutatás
A megbízható AI alapjai: a platform-determinisztikus inferencia elengedhetetlen
ArXiv AI
- Kutatás
A domain-specifikus gépi fordítás és minőségértékelés rendszerek fejlesztése
ArXiv NLP
- Kutatás
Új modell javítja az érzelmek felismerését a multimodális beszélgetésekben
ArXiv NLP
- Kutatás
Az LVFace felülmúlja az ArcFace/ResNet modellt az arcfelismerésben
Reddit ML
- Kutatás
Kilencszer gyorsabb képgenerálás: az A-SelecT kiszűri a felesleges lépéseket
ArXiv AI
- Kutatás
A Claude modell 1 óra alatt oldotta meg Knuth nyitott Hamilton-feladatát
Hacker News
- Kutatás
Egy új benchmark leleplezi a nagy nyelvi modellek fizikai törvényeket sértő hibáit
Reddit ML
- Kutatás
Matt Webb: az ügynököt nem érdekli a kód, hanem az architektúra
Simon Willison
- Kutatás
Stanford-kutatás: az AI rendszerek politikai szuperintelligenciát is lehetővé tehetnek
Import AI
- Kutatás
AI-alapú öntanuló rendszer érzékeli az ívhibákat a napelemes panelekben
ArXiv AI