ÉlőUtoljára: 2 perceMa: 18

Rovat · 9. oldal

Hardver & Infra

AI chipek (Nvidia, Google TPU), adatközpontok, edge computing

220 cikk az archívumban

Nvidia: 1 billió dollár feletti bevételt vár AI chipekből 2027 végéig
Hardver & Infra

Nvidia: 1 billió dollár feletti bevételt vár AI chipekből 2027 végéig

A vállalat korábbi becsléseit jelentősen felülmúló új előrejelzés mögött az AI chipek iránti növekvő kereslet és a technológia gyors fejlődése áll.

Ben's Bites·AI
Diszaggregált inferencia: 2-4x-es költségcsökkentés az LLM-ek futtatásánál
Hardver & Infra

Diszaggregált inferencia: 2-4x-es költségcsökkentés az LLM-ek futtatásánál

Ezt a költségcsökkentést egy olyan új architektúra segítségével lehet elérni, amely szétválasztja a számításigényes és a memóriakorlátos feladatokat, és így hatékonyabban használja ki a rendelkezésre álló erőforrásokat.

Towards Data Science·AI
Zsugorodik az OpenAI Stargate terve: Microsoft és Google kapja a kapacitásokat
Hardver & Infra

Zsugorodik az OpenAI Stargate terve: Microsoft és Google kapja a kapacitásokat

Az OpenAI eredeti, ambiciózus európai Stargate adatközpont-tervei jelentősen csökkentek, a cég nem tartja magát a korábbi elképzelésekhez.

The Decoder·AI
A chipek hőkezelése kulcsfontosságúvá vált az új architektúrákban
Hardver & Infra

A chipek hőkezelése kulcsfontosságúvá vált az új architektúrákban

Az egyre vékonyabb rétegekkel és komplex anyagokkal épülő, háromdimenziós chipekben a hőáramlás szabályozása ma már alapvető tervezési szemponttá vált.

IEEE Spectrum AI·AI
Régi telefonok kelnek életre: AI szerverként kapnak új feladatot
Hardver & Infra

Régi telefonok kelnek életre: AI szerverként kapnak új feladatot

Több ezer felhasználó alakítja át régi mobiltelefonját otthoni AI szerverré, kihasználva azok alacsony fogyasztású processzorait és beépített akkumulátorait.

Reddit LocalLLaMA·AI
Az OpenAI felfüggesztette a brit Stargate adatközpont-projektet a magas energiaárak miatt
Hardver & Infra

Az OpenAI felfüggesztette a brit Stargate adatközpont-projektet a magas energiaárak miatt

Az OpenAI szünetelteti Stargate projektjét az Egyesült Királyságban, mert a magas energiaárak és szabályozási környezet miatt nem térül meg a beruházás.

Bloomberg Technology·AI
A Goldman szerint a chipgyártók a befektetési aranybánya az AI-boom idején
Hardver & Infra

A Goldman szerint a chipgyártók a befektetési aranybánya az AI-boom idején

A félvezetőgyártók kulcsfontosságúak az AI-boom tőkebefektetéseinek felgyorsulásában, mivel a mesterséges intelligencia infrastruktúrája nem épülhet fel nélkülük.

Bloomberg Technology·AI
Az Nvidia Mission Control hidalja át a GB200-as szupergépek és az AI-ütemezés szakadékát
Hardver & Infra

Az Nvidia Mission Control hidalja át a GB200-as szupergépek és az AI-ütemezés szakadékát

Az új szoftveres megoldás az NVIDIA Grace Blackwell NVL72 rendszerek vezérlését teszi lehetővé, integrálva a Slurm és a Run:ai platformokat.

Nvidia Developer·AI
Az Astropad megreformálja a távoli asztalt az AI ügynököknek
Hardver & Infra

Az Astropad megreformálja a távoli asztalt az AI ügynököknek

A TechCrunch beszámolója szerint a Workbench-et az „AI-korszakra” tervezték, és az Apple eszközökkel való kompatibilitása miatt különösen nagy érdeklődés övezi.

TechCrunch·AI
Az Uber százezernyi AWS Graviton chipre áll át
Hardver & Infra

Az Uber százezernyi AWS Graviton chipre áll át

A kaliforniai székhelyű vállalat kedden jelentette be, hogy bővíti az Amazon felhőszolgáltatásait, és az AWS Graviton chipjeit használja a fuvarmegosztó funkciókhoz.

TechCrunch·AI
Az Intel menti meg Elon Musk Terafab AI chipgyárát
Hardver & Infra

Az Intel menti meg Elon Musk Terafab AI chipgyárát

Az Intel az Austinban épülő félvezetőgyár tervezésében és kivitelezésében is részt vesz, amely a SpaceX és a Tesla mesterséges intelligencia chipjeit gyártja majd.

The Verge·AI
A Samsung nyolcszoros profitot ért el az AI-chipek iránti őrült kereslet miatt
Hardver & Infra

A Samsung nyolcszoros profitot ért el az AI-chipek iránti őrült kereslet miatt

A dél-koreai gyártó működési nyeresége 57,2 billió vonra, azaz 37,9 milliárd dollárra ugrott az első negyedévben, ezzel rekordot döntött.

Bloomberg Technology·AI
A memóriahiány fojtogatja az AI-t: A nagy nyelvi modellek sebessége forog kockán
Hardver & Infra

A memóriahiány fojtogatja az AI-t: A nagy nyelvi modellek sebessége forog kockán

Az AI-adatközpontok memóriachipek iránti „falánk étvágya” miatt az amerikai áramfogyasztás 2028-ra elérheti az országos fogyasztás 12 százalékát.

IEEE Spectrum AI·AI
Irán az OpenAI 30 milliárd dolláros Stargate adatközpontját fenyegeti
Hardver & Infra

Irán az OpenAI 30 milliárd dolláros Stargate adatközpontját fenyegeti

A fenyegetés mögött az Egyesült Államok és Irán közötti fokozódó feszültség áll, ami az amerikai és iráni érdekek ütközésével jár a régióban.

The Verge·AI
Az Intel chipcsomagolással támadja az AI-piacot, milliárdos üzletekkel
Hardver & Infra

Az Intel chipcsomagolással támadja az AI-piacot, milliárdos üzletekkel

A technológiai óriás az AI-chipekhez elengedhetetlen, fejlett chipcsomagolási technológiájával a Google-t és az Amazont is megcélozza, milliárdos bevételre számítva.

Wired·AI
A 16 GB VRAM a belépő, de még itt is vannak csapdák a lokális LLM-eknél
Hardver & Infra

A 16 GB VRAM a belépő, de még itt is vannak csapdák a lokális LLM-eknél

A modern, kompakt LLM-ek már pontosan és gyorsan futnak 16 GB VRAM-mal, kompromisszumok nélkül.

Reddit LocalLLaMA·AI
Az Nvidia központi radarfeldolgozása 100-szor több információt ad
Hardver & Infra

Az Nvidia központi radarfeldolgozása 100-szor több információt ad

Az Nvidia új radar-feldolgozó architektúrája 30%-kal csökkenti a költségeket, 20%-kal a méretet és 20%-kal az energiafogyasztást a hagyományos megoldásokhoz képest.

Nvidia Developer·AI
Az Nvidia chipje 1 milliszekundán belül felismeri az arcokat
Hardver & Infra

Az Nvidia chipje 1 milliszekundán belül felismeri az arcokat

Egyetlen milliszekundum alatt azonosítja az arcokat az Nvidia legújabb chipe — a technológiát Ben Keller mérnök mutatta be februárban San Franciscóban.

IEEE Spectrum AI·AI
NVIDIA DGX Spark: hat hónap után sem érkezett meg az NVFP4
Hardver & Infra

NVIDIA DGX Spark: hat hónap után sem érkezett meg az NVFP4

A VLLM jelenlegi verzióiban az FP4 nem használható ki megfelelően az NVIDIA DGX Spark hardverén, ami jelentős teljesítménycsökkenést eredményez.

Reddit LocalLLaMA·AI
Zero-trust architektúrát épít az Nvidia a bizalmas AI-gyárak számára
Hardver & Infra

Zero-trust architektúrát épít az Nvidia a bizalmas AI-gyárak számára

A bizalmas AI-gyárakban használt modellek többsége jelenleg nyílt forráskódú, az Nvidia megoldása azonban lehetővé teszi a szabadon választható, zárt forráskódú modellek használatát is.

Nvidia Developer·AI
Az új metamateriál-chipek forradalmasíthatják az AI adatközpontokat
Hardver & Infra

Az új metamateriál-chipek forradalmasíthatják az AI adatközpontokat

A Lumotive 10 000 portos kapacitást célzó fejlesztésével az iparág szabványos 256 portos kapacitását sokszorosára növelheti.

IEEE Spectrum AI·AI

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

Támogatom