自动驾驶大模型算法(理解生成一体)
岗位信息
| 招聘单位 | momenta |
|---|---|
| 工作地点 | 北京、上海、苏州 |
| 官方更新时间 | 2026-05-19 11:35:24 |
职位描述
职位技术背景(满足以下至少一项)
(一)理解生成一体 / VLA 方向
1、有VLA模型、多模态大模型或端到端自动驾驶模型的研发经验,理解视觉、语言、动作等多模态信息的对齐与协同。
2、在模型结构上曾设计过理解与生成共享主干或联合训练策略,例如统一输出感知结果与轨迹/动作。
(二)世界模型 / 生成式模型方向
1、熟悉Diffusion Model、自回归时序模型或世界模型(如Video Action Model、DriveDreamer、GAIA-1),有视频生成、未来帧预测、轨迹生成等相关实践经验。
2、了解如何将理解得到的结构化信息(如BEV、占据网格、语义图)作为条件引导生成过程。
(三)端到端决策与控制方向
1、在模仿学习、强化学习或端到端Planning方向有深入研究,有一段式/End2End自动驾驶项目经验。
2、对“理解引导规划”或“规划与感知联合优化”有实际项目或论文产出。
任职要求
1、计算机科学、人工智能、机器人、自动化等相关专业硕士及以上学历。
2、扎实的编程能力,熟练使用Python/C++,具备良好的数据结构与算法基础。
3、熟悉主流深度学习框架(PyTorch等),对模型训练、优化与工程实现有深入理解。
加分项
1、在CVPR/ICCV/ECCV/NeurIPS/ICLR/ICML/TPAMI等顶会或期刊发表过理解生成一体相关论文。
2、作为核心贡献者参与过有影响力的开源项目(如UniAD、DriveDreamer、OpenVLA等)。
3、在ACM-ICPC/CCPC/RoboMaster/RoboCup等竞赛中取得优异成绩。
4、具备自动驾驶算法从研发到真实系统落地的完整经验,尤其是端到端模型上车经历。
提示:投递请认准招聘单位官方招聘官网,谨防中介收费。