| 英文术语 | 中文 | 大白话解释 |
|---|---|---|
| quadrupedal robot | 四足机器人 | 四条腿的机器人,比轮式更能适应复杂地形,如宇树 Unitree、波士顿动力 Spot。 |
| skateboard mounting | 滑板登板(上板) | 机器人从地面爬上滑板并站稳的过程,本文的核心任务。 |
| Reverse Curriculum Reinforcement Learning | 反向课程强化学习 | 课程学习的一种「倒着用」:先从任务最简单的收尾阶段学起,再逐步增加起始难度。 |
| curriculum learning | 课程学习 | 像上课一样由易到难地训练:先学简单子任务,再过渡到完整任务。 |
| reinforcement learning (RL) | 强化学习 | 智能体通过与环境试错交互、按奖励信号学习最优策略的学习范式。 |
| policy | 策略 | 「看到什么状态 → 采取什么动作」的决策规则;训练机器人控制器就是在学策略。 |
| terminal phase | 收尾阶段 | 任务的最后一段(如已站在板上、保持平衡),是反向课程学习的起点。 |
| global coordinate frame | 全局坐标系 | 固定在环境(地面)上的参考坐标系;「滑板固定在全局坐标系」指滑板完全不动。 |
| initial condition | 初始条件 | 训练开始时机器人与滑板的位置/姿态设定;逐步放松初始条件=逐步加大难度。 |
| robustness | 鲁棒性 | 在条件变化(滑板位置、朝向偏移)下依然表现稳定的能力。 |
| transfer | 迁移(泛化) | 在一种场景下学到的能力用到另一种场景(如从固定滑板到移动滑板)。 |
| underactuation | 欠驱动 | 系统自由度多于可控自由度,「不能想动哪就动哪」的情况。 |
| passive dynamics | 被动动力学 | 不施加控制时,系统靠重力、惯性自然运动的行为。 |
| Model Predictive Control (MPC) | 模型预测控制 | 每步基于动力学模型滚动优化未来一段时间的控制量,四足机器人常用控制方法。 |
| actuator | 执行器(电机/液压作动器) | 把能量变成机械运动的部件,是腿足机器人「力气」的来源。 |
| heat losses | 热损耗 | 电机线圈发热浪费的能量;四足机器人电机热损耗可高达 76%,是「给机器人装轮子」的动机之一。 |
| simulation | 仿真 | 在计算机里模拟物理环境训练机器人,本工作全部实验在仿真中完成。 |
🎧 音频在文末,可先听一遍原文再读;每个英文句都配了逐句翻译。
关键词 Keywords:Quadrupedal Robot 四足机器人 | Skateboard Mounting 滑板登板 | Reverse Curriculum Learning 反向课程学习 | Reinforcement Learning 强化学习 | Locomotion 运动
先盲听一遍→再看对照稿→再听一遍。目标是听出关键词组(Reverse Curriculum Reinforcement Learning、mounting phase、gradual relaxation、mobile skateboard)和 GitHub 链接中的名字。