Nyílt súlyokkal adta ki a Holo4 modellt a H Company
A H Company új, nyílt súlyokkal rendelkező Holo4 modelljei képesek kattintani, gépelni, kódot írni és API-eszközöket hívni asztali számítógépen, weben és Androidon, miközben a korábbi modellekhez képest jelentősen csökkentik a feladatonkénti költségeket.

A H Company bemutatta a Holo4-et, egy általános célú számítógép-használati modellekből álló családját AI-ügynökök számára. A modellek képesek kattintani és gépelni a képernyőkön, kódot írni, valamint MCP vagy API eszközöket hívni. A Holo4 két méretben érhető el: Holo4 27B (sűrű) és Holo4 35B-A3B (Mixture of Experts, 3 milliárd aktív paraméterrel). Mindkettő 256 ezer tokenes kontextusablakot támogat a H Models API-n keresztül. (MarkTechPost)
A Holo4 35B-A3B Apache 2.0 licenccel rendelkező súlyokkal kerül forgalomba, így kereskedelmi célú, saját hosztolású telepítésre is alkalmas. A Holo4 27B súlyai CC BY-NC 4.0 licenc alatt állnak, így kereskedelmi használata a H Models API-n keresztül lehetséges. A Holo4 egy látás-nyelv modell, amelyet számítógép-használatra terveztek.
A Holo4 27B a Qwen3.8-27B modellből finomhangolással készült, míg a Holo4 35B-A3B a Qwen3.6-35B-A3B alapjaira épül. Mindkettő a H cég nyílt hai-agents harness-ével párosítható, amely képernyőképeket és eszközeredményeket küld a modellnek, majd végrehajtja a kért kattintásokat, gépeléseket, kódokat és eszközhívásokat.
Költséghatékony és pontos teljesítmény
A H Company saját benchmarkjai szerint a Holo4 27B modell 85,2%-os eredményt ért el az OSWorld teszten, feladatonként mindössze 0,08 dolláros költséggel. Ez jelentős javulás a Qwen3.8 27B alapmodell 84,3%-os eredményéhez és 0,22 dolláros feladatonkénti költségéhez képest. Az AndroidWorld teszten a Holo4 27B 85,1%-ot teljesített.
Hosszabb munkafolyamatok esetén a Holo4 27B 61,7%-ot ért el az OSWorld 2.0 teszten, feladatonként 1,22 dolláros költséggel, míg a Claude Opus 5.5 81,8%-ot teljesített 8,48 dolláros költséggel. Az AutomationBench teszten a Holo4 27B 45,4%-ot ért el, feladatonként mindössze 0,05 dollárért.
Fontos megjegyezni, hogy a csúcsteljesítményű modellek eltérő harness-eket és erőfeszítési szinteket használnak. Továbbá, a H Company által gyűjtött képzési adatok 480 feladatot tartalmaztak az AutomationBench 600 nyilvános feladatából. A megmaradt 120 feladaton a Holo4 27B 49,3%-os eredményt ért el.
Képzési folyamat és architektúra
A H Company belső folyamat-jai dokumentációk, képernyőképek és valós szoftverek alapján építenek környezeteket és ellenőrizhető feladatokat. Az Agentic Task Factory mintegy 10 000 feladatot hozott létre, beleértve 4000 webes alkalmazást, 3000 MCP szervert és 3000 asztali és operációs rendszer feladatot. A feladatok csak akkor maradnak fenn, ha a verifikáló elutasítja a közelítő hibákat, és az ügynöknek a valós felületen keresztül kell megoldania azokat.
A Supervised finomhangolás (SFT) fázisban 127 milliárd tokent használtak, ebből körülbelül háromnegyede sikeres ügynöki trajektória volt: 45% asztali, 14% webes, 12% MCP és API, valamint 3% mobil feladat. Két RL szakértőt képeztek aszinkron online RL segítségével, amelyek egyike az asztali és webes feladatokat, másik a terminál-, MCP- és API-feladatokat kezelte. Mindkettőt egyenlő súllyal egyesítették további képzés nélkül.
Árazás és elérhetőség
A Holo4 27B modell ára 0,40 dollár bemeneti és 3,00 dollár kimeneti tokenenként egymillió tokenre vetítve. A Holo4 35B-A3B modell ára 0,30 dollár bemeneti és 2,00 dollár kimeneti tokenenként. Az API OpenAI-kompatibilis, és az api.hcompany.ai/v1 címen érhető el. A Hugging Face gyűjteményében található súlyok BF16, FP8, NVFP4 és 4-bites GGUF formátumokban állnak rendelkezésre. A H Company helyi következtetéshez vLLM és llama.cpp használatát dokumentálja.
A H Company a Nemotron Coalition-ön keresztül az NVIDIA Nemotron 3 Nano Omni alapjára építette a Holotron4 Nano-t is, amely az OSWorld eredményét 21,0%-ról 76,3%-ra emeli az alapmodellhez képest. A Holo4 35B-A3B modell Apache 2.0 licenccel rendelkezik, míg a 27B súlyok nem kereskedelmi célúak. Az Opus 5.5 továbbra is vezet az OSWorld 2.0 teszten 81,8%-kal, szemben a Holo4 27B 61,7%-os eredményével.