| 英文术语 | 中文 | 大白话解释 |
|---|---|---|
| dexterous robotic grasping | 灵巧机器人抓取 | 用多指灵巧手(像人手)抓取物体,比两指夹爪灵活得多,也难得多。 |
| policy distillation | 策略蒸馏 | 把多个「老师」策略学到的本事,浓缩进一个「学生」网络里的技术。 |
| offline distillation | 离线蒸馏 | 先用老师策略离线生成大量轨迹数据,再离线训练学生网络,不依赖在线交互。 |
| dedicated policy network | 专用策略网络 | 本文第一步:为每一个物体单独训练一个 RL 策略,专精一件事。 |
| grasp trajectory | 抓取轨迹 | 一次完整抓取过程中手和手指的运动序列,是蒸馏用的「教材数据」。 |
| Transformer / self-attention blocks | Transformer / 自注意力块 | 大模型时代的核心网络结构;本文的通用网络最多堆了 12 个自注意力块。 |
| state-based setting | 基于状态的设定 | 输入是仿真器给出的精确状态(物体位姿、手指关节角),信息完美无噪声。 |
| vision-based setting | 基于视觉的设定 | 输入来自多视角重建的点云(带噪声),更接近真实世界,也更有挑战。 |
| seen / unseen objects | 见过的 / 未见过物体 | 测试的三种难度:训练见过的物体、见过类别里的新物体、完全没见过的类别。 |
| UniDexGrasp++ | UniDexGrasp++ | 前代 SOTA 方法,训练流程复杂(策略学习、聚类、课程学习、蒸馏),本文要超越的基线。 |
| point cloud | 点云 | 物体表面的一堆 3D 坐标点,视觉设定下灵巧手的「眼睛」。 |
| success rate | 成功率 | 抓取成功的次数占总尝试次数的比例,衡量抓取效果的核心指标。 |
🎧 音频在文末,可先听一遍原文再读;每个英文句都配了逐句翻译。
关键词 Keywords:Dexterous Grasping 灵巧抓取 | Policy Distillation 策略蒸馏 | Transformer | Scalability 可扩展性 | Vision-based Grasping 基于视觉的抓取
先盲听一遍→再看对照稿→再听一遍。目标是听出每个数字(12 self-attention blocks、thousands of objects、3.5%、7.7%、10.1%)和术语(policy distillation、dedicated policy networks、state-based、vision-based、UniDexGrasp++)。