Daytona 37%-os sikerességgel indít, A leggyorsabb agent-sandbox hidegindítása 2026-ban
A Daytona 0,27 másodperces medián hidegindítási időt ért el, de csak 37%-os sikerességgel a ComputeSDK 2026. augusztus 21-i tesztjén. Az E2B 1,61 másodperces, a Modal 0,88 másodperces mediánt produkált.

Négy tulajdonság döntő fontosságú: a hidegindítási idő egyidejűség mellett, a fájlrendszer állandósága a fordulók között, az egress politika és az alapjáraton történő számlázás. A Daytona árazási oldala 90 ms alatti sandbox-létrehozást ígér, az E2B-t általában 150 ms körül említik, a Modal pedig előre gyorsítótárazott konténerekhez másodperc alatti hidegindítást kínál. (MarkTechPost)
A ComputeSDK sandbox leaderboardja, amely 2026. augusztus 21-én futott, a következő eredményeket hozta: Vercel 0,67 mp (100% siker), Modal 0,88 mp (100%), Runloop 0,89 mp (100%), E2B 1,61 mp (100%), Cloudflare 5,06 mp (100%), Daytona pedig 0,27 mp-es mediánnal, de csak 37%-os sikerességgel.
A burst teszt és a valós idejű használat különbségei
A Daytona leggyorsabb közzétett mediánja valós, és egy korábbi teszten egyenként indítva 0,10 másodperces mediánnal hozott létre sandboxokat. Az augusztusi burst teszten azonban a mezőny leggyorsabb mediánját produkálta, de csak 100 kísérletből 37-et teljesített. Ahol a medián csak minden harmadik hívásnál érhető el, ott nem a késleltetés, hanem a kapacitás a lényeg.
A Runloop P95 értéke 3,3-szorosa a Modalénak, annak ellenére, hogy hasonló mediánokat produkálnak. A Cloudflare 5 másodperces mediánja az architektúrából adódik: a Sandbox SDK a Cloudflare Containers-en fut, amely egy konténerpéldányt ütemez és egy képet indít, ami nehezebb művelet, mint egy előre felmelegített Firecracker VM visszaállítása.
Költséghatékonyság és árazás
Az 1000 végrehajtásra vetített költségek eltérő képet mutatnak. Egy 90 másodperces, 50%-os átlagos CPU-használatú forgatókönyvben a Northflank a legolcsóbb (1,67 dollár), míg a Runloop a legdrágább (7,92 dollár). Egy valós ügynökciklusban, ahol a sandbox 10 percig aktív, de csak 5%-os átlagos CPU-használattal, a Northflank 11,11 dollárba kerül 1000 végrehajtásonként, míg a Runloop 52,80 dollárba. A Vercel ebben a forgatókönyvben a negyedik legolcsóbról a harmadik legolcsóbb helyre lép elő, miközben CPU-költsége 3,20 dollárról 2,13 dollárra csökken, míg másoké lineárisan skálázódik.
A Daytona GPU-díjai széles körben reprodukálhatók: 3,95 dollár/óra H100-ért. Élő árlistája szerint az igény szerinti H100 2,27 dollár/óra, a H200 pedig 2,61 dollár/óra. A harmadik féltől származó összehasonlító táblázatok ebben a kategóriában egy negyedéven belül elavulnak.
A teszteléshez érdemes a valós feladatokat mérni, nem az „echo hello” típusú egyszerűsített teszteket. Egy hasznos tesztkeretrendszer ugyanazt a munkamennyiséget futtatja mindenhol: telepíti a pandas-t, beolvas egy CSV-t, ábrázolja, majd visszaküld egy PNG-t. A teszteléshez rögzíteni kell a régiót, a képet, és közzé kell tenni mind a szekvenciális, mind a párhuzamos futtatási sorozatot, mivel ezek eltérő kérdésekre adnak választ. A ComputeSDK tesztje 2026. augusztus 21-én zárult le.