强化学习运控算法工程师(J17573)
岗位信息
| 招聘单位 | 浩鲸科技 |
|---|---|
| 工作地点 | 南京市 |
| 官方更新时间 | 2026-08-13T18:01:18 |
职位描述
一、岗位职责
1. 聚焦机器人操控、运动控制、导航场景,开展深度强化学习(DRL)算法的研发、调试与落地,重点推进Sim-to-Real迁移技术在真实机器人硬件上的规模化应用。
2. 设计并优化大规模并行仿真训练平台(如Isaac Gym、MuJoCo、Brax等),提升算法训练效率与策略泛化能力,支撑算法快速迭代。
3. 与感知、规划、控制等跨部门团队深度协作,完成强化学习策略与机器人完整系统的集成、调试,保障技术落地效果。
4. 搭建并完善RL训练基础设施,重点攻克reward shaping、curriculum learning、domain randomization等关键模块,夯实算法研发基础。
任职要求
二、任职要求
1. 学历要求:计算机科学、人工智能、机器人学、自动化或相关领域硕博士学位。
2. 经验要求:3年以上强化学习(RL)领域研究和工程经验,其中至少2年深度强化学习在机器人或物理仿真场景的实战经验(拒绝纯理论、纯非机器人场景RL从业者)。
3. 算法能力:精通PPO、SAC、TD3、DDPG、DreamerV3、Decision Transformer等主流RL算法,熟悉其理论基础,且具备扎实的工程实现能力(能独立完成算法落地)。
4. 工具/经验要求:熟练使用Isaac Gym、MuJoCo、PyBullet、Gazebo等至少一种主流机器人仿真环境,具备Sim-to-Real迁移实战经验(核心加分项)。
5. 软素质:具备优秀的跨团队沟通协调能力,良好的英文读写能力,能适应国际化团队协作模式,高效推进跨部门项目。
提示:投递请认准招聘单位官方招聘官网,谨防中介收费。