大模型Code/Agent后训练算法研究员-(深圳)or(北京)or
岗位信息
| 招聘单位 | 腾讯 |
|---|---|
| 部门/事业群 | CSIG |
| 所属产品 | 微信支付 |
| 工作地点 | 上海 |
| 经验要求 | 两年以上工作经验 |
| 官方更新时间 | 2026年08月03日 |
职位描述
1.负责Code和Agent相关数据构建与治理,构建高质量、多样化的Code/Agent训练数据集,搭建数据迭代闭环,通过数据飞轮持续优化数据质量;
2.负责Agent运行环境与训练环境的构建与优化,构建高可用、可扩展的Agent仿真环境,保障Agent训练、测试及落地的稳定性与高效性;
3.负责Agentic RL在Code/Agent场景的训练,参与Agentic RL Infra建设及优化、Agentic RL 算法优化,持续提升Agentic RL训练的效率和稳定性。
提示:投递请认准招聘单位官方招聘官网,谨防中介收费。