强化学习算法工程师/专家
岗位信息
| 招聘单位 | 智元机器人 |
|---|---|
| 工作地点 | 上海、北京 |
| 官方更新时间 | 2026-08-16 22:19:56 |
职位描述
- 负责具身基础模型的后训练与强化学习研发,持续提升机器人任务成功率、稳定性与泛化能力。
- 研究如何利用机器人真实执行中的成功、失败、人工干预及环境反馈进行持续学习。
- 构建高效、稳定、可扩展的 Offline / Online RL 与真机后训练体系。
- 探索机器人经验的数据配方与 Scaling Law,研究交互规模与模型能力增长之间的关系。
- 推动大规模真实机器人训练—执行—反馈—再训练闭环。
任职要求
- 硕士及以上学历,计算机、机器人、自动化、人工智能等相关方向,具备扎实的强化学习 / 深度学习基础和良好的代码能力。
- 熟悉强化学习、模仿学习或机器人学习,对 Offline / Online RL 等方向有较深入理解。
- 有 VLA 后训练、真机强化学习、大规模 RL 或多模态模型后训练经验者优先。
- 具备较强的实验能力,能够独立推进算法设计、训练和真实系统验证。
- 有高质量论文、开源项目或同等研究 / 工程成果者优先。
提示:投递请认准招聘单位官方招聘官网,谨防中介收费。