π 系列 VLA:从 π0 到 π0.7,机器人基础模型的四步演进通读 Physical Intelligence 的 π0、π0.5、π*0.6(RECAP)与 π0.7 四篇论文,推导流匹配动作专家、分层推理、优势条件化 RL 与多模态提示这四块拼图如何组成一条完整的机器人基础模型路线。2026年9月2日具身智能
足式机器人强化学习:sim-to-real 的鸿沟到底怎么跨从奖励函数逐项设计和大规模并行仿真讲起,拆解执行器建模、域随机化与教师-学生蒸馏这三件让 RL 策略真正跑上实机的事。2026年9月4日具身智能