视频生成RL算法工程师/专家 - Seed Model
岗位信息
| 招聘单位 | 字节跳动 |
|---|---|
| 工作地点 | 北京、上海、深圳 |
| 官方更新时间 | 2026-04-08 17:00:57 |
职位描述
团队介绍:字节跳动 Seed 团队成立于 2023 年,致力于寻找通用智能的新方法,追求智能上限,为科技和社会发展作出贡献。
Seed 团队在 AI 领域拥有长期愿景与决心,团队研究方向涵盖 MLLM、GenMedia、AI for Science、机器人等,在中国、新加坡、美国等地设有实验室和岗位。目前,团队已推出业界领先的通用大模型以及前沿的多模态能力,支持豆包、即梦、TRAE 等超过 50 个应用场景,并通过火山引擎开放给企业客户。第三方数据显示,豆包 App 用户量在中国市场排名第一,豆包大模型日均 Token 调用量行业领先。
1、负责基于DiT/Diffusion的视频生成模型研发与后训练优化,提升画质、美感、运动、一致性和指令响应等效果;
2、负责生成模型RL后训练框架及多模态Reward Model/Verifier的设计与迭代,推动RLHF、ReFL、GRPO、DPO等方法在图像/视频生成中的应用;
3、负责后训练全链路建设与业务落地,包括数据构建、模型评测、训练加速、推理优化、蒸馏压缩,并探索视频生成、交互编辑、音视频联合生成、Agent RL等方向。
任职要求
1、1-5年计算机视觉/多模态方向研究或实践经验,熟悉以下一个或多个方向:
1)生成模型后训练(如RLHF、DPO、GRPO、Reward-based Optimization等);
2)Reward Model/Verifier构建;
3)Agentic RL以及大规模训练优化;
2、具备扎实的工程实现能力,熟练使用Python/PyTorch,有分布式训练、性能优化、问题定位与实际落地经验者优先;
3、对生成式AI技术前沿与业务落地有热情,自驱力强,具备良好的学习能力、分析解决问题能力和跨团队协作能力;
4、在CVPR/ICCV/ECCV/NeurIPS/ICLR/ICML等顶会发表论文者优先,有ACM/ICPC、数学建模、编程竞赛等经历者加分。
提示:投递请认准招聘单位官方招聘官网,谨防中介收费。