资深CV 算法专家(基础模型方向)(J17138)
岗位信息
| 招聘单位 | 传音控股 |
|---|---|
| 工作地点 | 上海市、深圳市 |
| 官方更新时间 | 2024-12-06T10:54:28 |
职位描述
1. 负责 AIGC基础模型(文生图、图生图、图像编辑模型)的后训练体系建设,包括SFT、DPO、GRPO等强化学习方法设计与实现。
2. 构建大规模指令数据,用于人像生成、人像编辑、图像修复、目标消除、视频编辑等方向的SFT微调。
3. 设计奖励模型(Reward Model),包括但不限于:图像质量、真实感、结构保持;人像一致性、身份保持指令遵循与安全性。
4. 负责从通用基础模型到手机影像场景的能力迁移,指令适配、风格对齐等。
5. 提升模型对用户指令的理解能力,使生成编辑结果更稳定、更可控、更一致。
任职要求
1. 计算机、人工智能相关领域硕士/博士,基础扎实。
2. 熟练掌握SFT、指令微调、奖励建模或 RLHF/RLAIF/RL-based 后训练中的至少一项。
3. 熟悉扩散模型、MMDiT、流模型(Flow Matching / Rectified Flow)或其他生成式基础模型。
4. 擅长大模型后训练数据构建,指令设计、数据对齐、偏差处理、人像一致性评估。
5. 有基础模型对齐、后训练或奖励模型相关落地经验者优先。
加分项:
- 有人像编辑、人像生成或视觉多模态基础模型经验;
- 有实际 RLHF、DPO、PPO、RLAIF、GRPO 或其他RL后训练落地案例;
- 有构建 Reward Model 的实践经验(文本 RM / 图像 RM / 多模态 RM);
- 有顶会论文、开源项目、大模型训练搭建经验。
提示:投递请认准招聘单位官方招聘官网,谨防中介收费。