Összehasonlította a népszerű AI-eszközöket a Composio
A Composio által végzett tesztben a Claude Code 122 másodperc alatt teljesített egy feladatot, ám sikeres feladatonként 0,195 dollárba került, míg az OpenCode 0,073 dollárért dolgozott.

A szoftveres „wrapper” jelentősen befolyásolja a költségeket. Az AI-eszközöket fejlesztő Composio DeepSeek V4 Flash modellt tesztelt négy keretrendszeren – Claude Code, Codex, OpenCode és Oh My Pi – 30 valós feladaton, olyan eszközökkel, mint a Gmail, GitHub, Slack és Notion. (The Decoder)
Teljesítmény és hatékonyság
Egyetlen keretrendszer sem bizonyult minden kategóriában a legjobbnak. Az Oh My Pi érte el a legmagasabb, 17/30-as sikerességi arányt, de ez volt a leglassabb is, feladatonként 272 másodpercet vett igénybe. Az OpenCode volt a legolcsóbb, sikeres feladatonként 0,073 dolláros költséggel, míg a Claude Code volt a leggyorsabb 122 másodperccel, de a legdrágább is 0,195 dollárral, annak ellenére, hogy kevesebb eszközt hívott meg és kevesebb kimeneti tokent generált.
Költségkülönbségek
A sikerességi arányok viszonylag hasonlóak maradtak a keretrendszerek között; az OpenCode 14/30-at ért el. A valódi különbségek a költségekben és a sebességben mutatkoztak meg, közel háromszoros árkülönbséggel és 2,2-szeres sebességkülönbséggel a keretrendszerek között. A Composio tesztje kimutatta, hogy az OpenCode és a Claude Code között sikeres feladatonként 0,122 dolláros költségkülönbség alakult ki.