机器人入门两部曲的下篇,专讲软件。约 50 分钟的技术入门。
从经典控制论(PID 六十年统治、MPC、ZMP)讲到深度强化学习(DQN、AlphaGo、OpenAI Dactyl),到 behavior cloning 的复兴和 diffusion policy 的关键升级。
重头戏 V L A 模型:RT-1、RT-2、OpenVLA、Pi 0/0.5、NVIDIA GR00T、Figure Helix、Tesla 自家 V L A、DeepMind Gemini Robotics 一一讲解。
数据:teleoperation 远程操控为什么是当前最贵的人工成本、Open X-Embodiment 数据集、video pre-training、cross-embodiment、data flywheel 押注。
世界模型:J E P A、Genie、Sora、Pi 0.5 为什么是被押注的下一个范式。分层控制架构:从 task planner 到 V L A 到 joint controller 的五层频率分工。Sim-to-real 与 domain randomization、Isaac Sim / MuJoCo / Genesis 生态。记忆、长程任务、规划。
泛化的真问题——五级泛化阶梯、为什么实验室到家庭还有十年。中国机器人 AI 生态。三个 takeaway + 两部曲总结。