ÉlőUtoljára: az iméntMa: 12
Modellek & LLMfrissítve: 05:16

Bemutatta a Pegasus 1.6-ot a TwelveLabs, robotoknak segít a videóértelmezésben

A TwelveLabs bemutatta Pegasus 1.6 modelljét, amely képes emberi mozdulatok, feladatok és környezeti kölcsönhatások megértésére egocentrikus videókból, ezáltal segíti a robotok, drónok és autonóm járművek biztonságos működését.

Bemutatta a Pegasus 1.6-ot a TwelveLabs, robotoknak segít a videóértelmezésben
Fotó: Brands&People / Unsplash
forrás: The Robot Report·AI Forradalom szerk.·
Megosztás

A Pegasus 1.6 az első olyan AI-modell, amely képes egocentrikus videók értelmezésére, vagyis az emberi munkavégzés szemszögéből készült felvételek elemzésére. Jae Lee, a TwelveLabs társalapítója és vezérigazgatója szerint a modell pontosabb megértést biztosít a robotika és az adatcsapatok számára, hogy aztán szükségleteiknek megfelelő betanítási adatokká alakíthassák. (The Robot Report)

Hardverfüggetlen működés

A Pegasus 1.6 nem igényel speciális kamerákat vagy hardvert, elegendő, ha az emberi cselekvések és kölcsönhatások rögzítésre kerülnek az operátor szemszögéből. A modell képes meglévő videóadatokkal dolgozni, és állóképeket is elemezni tud. A cég szerint az egocentrikus videók gyűjtése és skálázása könnyebb, mint a távirányítású adatoké, így a felvételeket hasznosabbá tehetik a robotikai csapatok számára.

Munkafolyamatok és adatvédelem

A Pegasus 1.6 öt, videóalapú munkafolyamatot támogat. Ezek közé tartozik az automatikus akciófelismerés és címkézés, amely pontos, időbélyeggel ellátott adatokat generál a feladatokhoz, lépésekhez, tárgyakhoz és kéz-tárgy interakciókhoz. Támogatja a sűrű feliratozást a robotok természetes nyelvi megértéséhez, minőségértékelést a gyenge minőségű videók kiszűrésére, valamint keresést és kurálást ritka események és duplikált klipek felderítésére. Emellett képes arcok, járókelők és érzékeny adatok felismerésére és jelölésére az adatvédelmi és megfelelőségi előírások betartása érdekében.

A Pegasus 1.6 a TwelveLabs korábbi, nagyméretű videótárakkal rendelkező vállalati ügyfelei számára kifejlesztett videóértelmezési képességeire épít. A modell továbbfejlesztett entitásfelismerést kínál a kezek, tárgyak és eszközök következetesebb nyomon követéséhez, és gyorsabb, költséghatékonyabb feldolgozást tesz lehetővé nagy mennyiségű videómunkafolyamat esetén. A rendszer a videóértelmezést más szenzorokkal is kiegészíti, azonosítva a cselekvéseket, azok pontos időbeli szegmenseit, a kezek mozgását és a környezeti változásokat.

A TwelveLabs robotikai fejlesztőkkel való együttműködését is bővíti. A cég robotikai laborokkal és adatcsapatokkal dolgozik együtt, hogy videóadatokat használjanak a robotok betanításának skálázására, különösen a dexteritást és manipulációt igénylő feladatok, mint a csomagolás, összeszerelés és tisztítás, valamint speciális ipari alkalmazások, például félvezető minőségellenőrzés terén. A cél, hogy a humán viselkedésről készült videóanyagok nagymértékben hasznosíthatóvá váljanak a robotok betanításához.

Forrás

Feldolgozott sajtóforrás·The Robot Report

Eredeti cikk megnyitása →

Ez a cikk a fenti sajtóforrás alapján készült AI-összefoglalóval.

tetszett a cikk? oszd meg →
Megosztás

Tetszik az oldal? Támogasd a fejlesztést

Az AI Forradalom egy automatizált pipeline: napi adatgyűjtés, LLM-feldolgozás és infrastruktúra fenntartása valódi költségekkel jár. Ha értékesnek találod a tömör, naprakész AI-összefoglalókat, egy kávé sokat segít.

☕ Támogatom