标签: #openvla
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 1 篇
机器人能看、能听、能动 — VLA 模型 RT-2 与 OpenVLA 评述
视觉-语言-行动(VLA)模型接收摄像头画面和自然语言指令,直接输出机器人的动作。本文以 RT-2、Open X-Embodiment、OpenVLA 为主线,梳理 VLA 范式的思路、架构、动作分词方式,以及优势与局限。
2026-06-27 · 24 分钟阅读 #ai-papers#robotics#vla#rt-2#openvla