VLA 发展详解:从 RT-2、OpenVLA、π0 到 π0.5 与 π0.7
沿 RT-2、OpenVLA、π0 到 π0.5、π0.6 与 π0.7,解释机器人每步输入、动作编码、连续生成、数据与训练配方,以及泛化、强化学习和多模态引导的演进。
Topic
10 related articles.
沿 RT-2、OpenVLA、π0 到 π0.5、π0.6 与 π0.7,解释机器人每步输入、动作编码、连续生成、数据与训练配方,以及泛化、强化学习和多模态引导的演进。
从 PICO 遥操作、主从机械臂、UMI 与人类视频,到 BEHAVIOR、RoboCasa 和空间世界模型,比较数据监督、动作迁移、采集工程与截至 2026 年 9 月的研究进展。
结合原论文与 lucidrains 实现,拆解地形配对参考增强、多专家 DAgger、阶段条件 AMP 和深度 GRU 策略,并用 CPU 实验核对奖励、PPO、蒸馏与时序接口。
从官方论文与源码理解 X-VLA 的软提示、多视角编码、动作生成与两阶段适应,逐项核对 EE6D、旋转排列、数据接口和 LIBERO 部署。
结合三篇论文与 Kinetix 官方实现,解释 RTC 的时间对齐、软掩码、VJP 引导、训练时前缀条件,以及高延迟世界动作模型的实时部署。
从工具点云、行为克隆和可微运动学展开理解 ELMP,详解梯度路径、碰撞损失、实验口径与复现边界。
结合 RynnBrain 1.0/1.1 论文、模型配置和官方示例,解析时空定位、接触点、3D Grounding、跨本体动作建模及复现边界。
从 InternVL 3.5 官方模型集合出发,详解视觉 token、MPO/GSPO、ViCO 路由、检查点选择、显存预算与可验证推理流程。
依据 Being-0 论文梳理分层具身智能系统与实验结果,区分论文报告、概念示意和个人工程解读。
详解 CoACD 的三项核心设计:碰撞感知凹度、直接网格切割与 MCTS,逐步追踪评分、选刀、细化、递归和合并。