π 系列 VLA:从 π0 到 π0.7,机器人基础模型的四步演进通读 Physical Intelligence 的 π0、π0.5、π*0.6(RECAP)与 π0.7 四篇论文,推导流匹配动作专家、分层推理、优势条件化 RL 与多模态提示这四块拼图如何组成一条完整的机器人基础模型路线。2026年9月2日具身智能
ACT 与 Diffusion Policy:模仿学习的两条生成式路线从行为克隆的复合误差与多模态困境出发,推导 ACT 的 CVAE 动作分块与 Diffusion Policy 的去噪生成各自如何解决这两个问题,以及工程上如何二选一。2026年9月3日具身智能