标签: #diffusion-policy
关于 GPU、LLM、MLOps、Kubernetes 以及心态的文章 · 1 篇
Diffusion Policy 与 π0 — 平滑机器人行为背后的秘密
跨越离散动作 token 的局限,本文考察将动作生成为连续值的两条思路。Diffusion Policy 通过去噪生成动作,π0 则用 flow-matching 生成高频连续动作。我们梳理两种方法的思路、架构、控制频率、优势与局限。
2026-06-27 · 24 分钟阅读 #ai-papers#robotics#diffusion-policy#pi0#flow-matching