快速导航
- MPC详细介绍
- PPO,DPO,GRPO和DAPO的原理与区别
- PPO、DDPG、TD3、SAC算法
- PPO原理,优点,为什么人形机器人领域最常用
- CLip机制
- KL散度,静态或自适应
- 正逆运动学
- 运动学与动力学
- 雅可比矩阵,维度,作用分别是什么
- 机械臂的奇异点问题
- 同一个末端位姿对应多组关节解,如何选最优
- 关节控制用PD还是PID?
- sim2real,相机标定,手眼标定,内参外参,domain randomization
- AMP优缺点,数据依赖,调参难度
- PHC,Sonic,beyondMimic的区别
- motion retarget的pipeline详解
- 全身控制一体化与解耦控制
- 样本效率低怎么解决
- transformer的QKV机制,自注意力机制和交叉注意力机制
- DP,DIT,Flow Matching分别是什么,训练方式有什么区别
- 边缘设备部署模型与优化
- 奖励函数的设计
- 课程学习如何设置
- 离线与在线强化学习
- 真机安全问题(算法、控制、物理层面分开讨论)