2026. augusztus 11., kedd · Kutatás
Capek 0.5: végrehajtás-központú AI-modell robotoknak
Kutatók egy arXiv-preprintben bemutatták a Capek 0.5 nevű vizuális-nyelvi modellt, amelyet kifejezetten robotikai, testesült ágensek irányítására fejlesztettek. A modell újítása, hogy a képességeket nem feladatok vagy adathalmazok szerint, hanem a végrehajtási folyamatban betöltött funkciójuk alapján négy csoportba rendezi: térbeli következtetés, időbeli megértés, cselekvésirányítás és állapotellenőrzés. A szerzők állítása szerint minden képességet külön specialista tanul meg megerősítő tanulással, majd ezeket súlytér-egyesítéssel és irányított policy-desztillációval vonják össze egyetlen modellbe, 2 milliárd és 35 milliárd (aktivált 3 milliárd) paraméteres verzióban. A cikk szerint az egyesített modell megtartja mind a négy különálló képességet, és zárt hurkú, szimulált robotfeladatokon is átvihető. Mivel a dokumentum nem lektorált preprint, az eredmények függetlenül nem megerősítettek.
Miért fontos?
A munka egy strukturált módot javasol arra, hogyan lehet egy vizuális-nyelvi modellben egyszerre megtartani a robotvezérléshez szükséges, egymástól eltérő képességeket, ami a testesült AI-kutatás kulcskérdése.
Források
Említve a tudásbázisban
Kapcsolódó témák
Napi összefoglaló
Ez a hír a 2026. augusztus 11., kedd napi AI összefoglaló része.