QR kód

Vision-Language-Action Models for Robotics: A Review Towards Real-World Applications

Amid growing efforts to leverage advances in large language models (LLMs) and vision-language models (VLMs) for robotics, Vision-Language-Action (VLA) models have recently gained significant attention. By unifying vision, language, and action data at scale, which have traditionally been studied sepa...

Celý popis

Uloženo v:
Podrobná bibliografie
Hlavní autoři: Kento Kawaharazuka, Jihoon Oh, Jun Yamada, Ingmar Posner, Yuke Zhu
Médium: Artigo
Jazyk:Inglês
Vydáno: IEEE 2025-01-01
Edice:IEEE Access
Témata:
On-line přístup:https://ieeexplore.ieee.org/document/11164279/
Tagy: Přidat tag
Žádné tagy, Buďte první, kdo vytvoří štítek k tomuto záznamu!