タグ: #rt-2
GPU・LLM・MLOps・Kubernetes、そしてマインドセット · 1 件
ロボットが見て聞いて動く — VLAモデル RT-2とOpenVLAのレビュー
ビジョン・言語・行動(VLA)モデルは、カメラ映像と自然言語の指示を受け取り、ロボットの行動を直接出力します。RT-2、Open X-Embodiment、OpenVLAを中心に、VLAパラダイムの考え方、アーキテクチャ、行動トークン化、長所と限界を整理します。
2026-06-27 · 27 分で読めます #ai-papers#robotics#vla#rt-2#openvla