ÉlőUtoljára: 42 perceMa: 18

Rovat · 61. oldal

Kutatás

AI research papers, arXiv publikációk, benchmarkok, tudományos áttörések

1332 cikk az archívumban

Egy kutatópáros szerint az AI valódi áttörése nem egyéni modellektől, hanem együttműködéstől várható
Kutatás

Egy kutatópáros szerint az AI valódi áttörése nem egyéni modellektől, hanem együttműködéstől várható

Ha az AI modellek nem versenyeznek, hanem együttműködnek, szélesebb megoldásteret fedeznek fel — és kisebb eséllyel ragadnak le a korai, téves konszenzusnál.

ArXiv AI·AI
Felfedezték az AI-ügynökök spontán szocializációját
Kutatás

Felfedezték az AI-ügynökök spontán szocializációját

S.O. Lidarity és munkatársai szerint a szemi-autonóm AI-ügynökökben spontán szocializáció figyelhető meg.

ArXiv AI·AI
Az NVIDIA egy nap alatt képes domain-specifikus embedding modellt képezni
Kutatás

Az NVIDIA egy nap alatt képes domain-specifikus embedding modellt képezni

Az Atlassian 26%-os javulást ért el a Recall@60 értékben, miután finomhangolta a modellt a JIRA adathalmazon.

Hugging Face·AI
A Hugging Face nyílt forráskódú AI-ökoszisztémája 13 millió felhasználót számlál
Kutatás

A Hugging Face nyílt forráskódú AI-ökoszisztémája 13 millió felhasználót számlál

Több mint 30 százaléka a Fortune 500-nak már most is használja a Hugging Face nyílt forráskódú modelljeit.

Hugging Face·AI
A Meta új technikája 93%-ra növeli az LLM-ek kódellenőrzési pontosságát
Kutatás

A Meta új technikája 93%-ra növeli az LLM-ek kódellenőrzési pontosságát

A Meta új technikáját a Claude Opus-4.5 és Sonnet-4.5 modellek tesztelték, amelyek 93%-os pontosságot értek el a kódellenőrzési feladatokban.

VentureBeat·AI
Az OpenAI eszközei hónapok alatt váltak használhatóvá az nyílt forráskódú fejlesztőknek
Kutatás

Az OpenAI eszközei hónapok alatt váltak használhatóvá az nyílt forráskódú fejlesztőknek

Greg Kroah-Hartman, a Linux stable kernel maintainer, szerint az AI-eszközök minősége hónapok alatt jelentősen javult.

ZDNet AI·AI
A TurboQuant technika nagy részben kompenzálja a Q8_0 kv quantizálás csökkentését
Kutatás

A TurboQuant technika nagy részben kompenzálja a Q8_0 kv quantizálás csökkentését

A Reddit közösség szerint a TurboQuant technika, különösen az attention rotation, nagyrészt helyreállítja az AIME25 teszten a Q8_0 kv kvantizálás miatti teljesítménycsökkenést, bár a teljes csomag hatékonysága még bizonyítatlan.

Reddit LocalLLaMA·AI
Egy fejlesztő létrehozott egy autonóm ML ügynököt, ami végeláthatatlanul futtat kísérleteket tabuláris adatokon
Kutatás

Egy fejlesztő létrehozott egy autonóm ML ügynököt, ami végeláthatatlanul futtat kísérleteket tabuláris adatokon

A Reddit felhasználó, aki az AutoResearch projektből merített ihletet, egyetlen GPU-val tesztelte a fejlesztést.

Reddit ML·AI
Betekintés a transformer rétegekbe: így dolgoznak az inference motormeghajtások
Kutatás

Betekintés a transformer rétegekbe: így dolgoznak az inference motormeghajtások

A Vicuna-13B modellhez hasonló nyelvi modellek fejlesztésében kulcsszerepet játszanak az olyan technológiák, mint a self-attention és a finomhangolás.

Reddit LocalLLaMA·AI
Egy 9 soros seed és 5 kör kontrasztív visszajelzés felülmúlja az Optunát 96%-ban
Kutatás

Egy 9 soros seed és 5 kör kontrasztív visszajelzés felülmúlja az Optunát 96%-ban

A Reddit felhasználók szerint a kontrasztív visszajelzés technika hatékonysága a szabályozatlan betanítással kombinálva 20%-kal növelte a modell teljesítményét.

Reddit ML·AI
Sűrűség-érzékeny kontextus-kompresszió új módszerrel
Kutatás

Sűrűség-érzékeny kontextus-kompresszió új módszerrel

Yijiong Yu és munkatársai egy új keretrendszert mutattak be, amely a kontextus kompresszióját optimalizálja az információ sűrűségének figyelembevételével.

ArXiv NLP·AI
Kutatók kimutatták, hogy az összeesküvés-elméletek nem uniformán fejlődnek
Kutatás

Kutatók kimutatták, hogy az összeesküvés-elméletek nem uniformán fejlődnek

Manisha Keim és munkatársai 169,9 millió Reddit-kommentet elemeztek, és megállapították, hogy az összeesküvés-elméletek nyelvi jellemzői idővel dinamikusan változnak.

ArXiv NLP·AI
A Lens Academy alapítója keresi társát, már vannak felhasználók és finanszírozás
Kutatás

A Lens Academy alapítója keresi társát, már vannak felhasználók és finanszírozás

Luc Brinkman, a Lens Academy alapítója egy olyan társat keres, aki vagy technikai, vagy nem-technikai szakértő, és akivel együttműködve fejleszthetik az AI Safety oktatást.

LessWrong AI·AI
Az AutoB2G keretrendszer természetes nyelvi leírások alapján automatizálja az épület-hálózat szimulációt
Kutatás

Az AutoB2G keretrendszer természetes nyelvi leírások alapján automatizálja az épület-hálózat szimulációt

Borui Zhang és munkatársai által kidolgozott AutoB2G keretrendszer 2,255 KB méretű, és cs.AI kategóriába tartozik.

ArXiv AI·AI
A RASPRef keretrendszer fejleszti a promptokat emberi felügyelet nélkül
Kutatás

A RASPRef keretrendszer fejleszti a promptokat emberi felügyelet nélkül

Rahul Soni által bemutatott RASPRef keretrendszer képes önállóan finomhangolni a promptokat a DeepSeek R1 és az OpenAI o1 modellekhez, miközben a GSM8K-szerű matematikai feladatokon mérhető javulást ér el emberi felügyelet nélkül.

ArXiv NLP·AI
Az utolsó ujjlenyomat: hogyan formálja a markdown az LLM szövegét
Kutatás

Az utolsó ujjlenyomat: hogyan formálja a markdown az LLM szövegét

E. M. Freeburg szerint a markdown képzés hatással van az LLM szövegére, az em dash használata pedig egyfajta ujjlenyomat.

ArXiv NLP·AI
Az OpenAI és a Google fejleszti a nyelvi modellek szabályozhatóságát
Kutatás

Az OpenAI és a Google fejleszti a nyelvi modellek szabályozhatóságát

Több mint 100 ezer felhasználó járult hozzá a GPT-4o visszavonásához.

Reddit ML·AI
PyTorch DDP-vel építsünk gyártásra képes, több csomópontos tanulási folyamatot
Kutatás

PyTorch DDP-vel építsünk gyártásra képes, több csomópontos tanulási folyamatot

A 27-oldalas tanulmányban a szerzők bemutatják, hogyan lehet PyTorch DistributedDataParallel segítségével több csomópontos, gyártásra kész tanulási folyamatot felépíteni, a teljes, moduláris kódbázist pedig a GitHub-on elérhetővé tették.

Towards Data Science·AI
A robotok is megtanulhatják a statisztikai csalást
Kutatás

A robotok is megtanulhatják a statisztikai csalást

Jaemin Han szerint a p-hackinggal a kutatók a hipotézisük igazolására törekednek, és ennek során akár 40%-ra is növelhetik a hamis pozitív eredmények arányát.

Towards Data Science·AI
A LocalLLaMA 2026 modellje már jobb lehet a GPT-3.5-nél
Kutatás

A LocalLLaMA 2026 modellje már jobb lehet a GPT-3.5-nél

A Meta kutatói szerint a LocalLLaMA 2026-os változata akár 10%-kal javíthatja a nyelvi megértést, ami potenciálisan felülmúlja a GPT-3.5-öt, bár a részletek jelenleg a Reddit blokkolása miatt korlátozottak.

Reddit LocalLLaMA·AI
A LessWrong kutatói felfedezik: az LLM-ekben az elhitetés hathatós eszköz az irányításban
Kutatás

A LessWrong kutatói felfedezik: az LLM-ekben az elhitetés hathatós eszköz az irányításban

A williawa által végzett kutatás kimutatta, hogy a szintetikus dokumentum-fine-tuning segítségével tetszőleges hiteket lehet a modellekbe építeni, ami jelentősen befolyásolja az LLM-ek viselkedését és hatékony eszközzé válik az irányításukban.

LessWrong AI·AI

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom