大模型Multi-Agent RL算法研究员 - Seed Model
岗位信息
| 招聘单位 | 字节跳动 |
|---|---|
| 工作地点 | 北京 |
| 官方更新时间 | 2026-05-12 11:30:35 |
职位描述
团队介绍:字节跳动 Seed 团队成立于 2023 年,致力于寻找通用智能的新方法,追求智能上限,为科技和社会发展作出贡献。
Seed 团队在 AI 领域拥有长期愿景与决心,团队研究方向涵盖 MLLM、GenMedia、AI for Science、机器人等,在中国、新加坡、美国等地设有实验室和岗位。目前,团队已推出业界领先的通用大模型以及前沿的多模态能力,支持豆包、即梦、TRAE 等超过 50 个应用场景,并通过火山引擎开放给企业客户。第三方数据显示,豆包 App 用户量在中国市场排名第一,豆包大模型日均 Token 调用量行业领先。
1、针对前沿的长程任务进行优化,手段包括但不限于Large-Scale RL、Multi-Agent RL、Multi-Agent Harness Design、Self-Evolving Algorith,能突破传统发版技术积极思考探索并开展实验;
2、创新Multi-Agent训练技术,推出适合内部Multi-Agent框架的模式。
任职要求
1、对语言模型和强化学习有着深厚的知识储备和深入理解,对AI进行复杂任务有热情和信仰,有很强的研究好奇心和与之匹配的行动力;有AI相关领域的博士学位,或者1年以上的相关领域核心岗位工作经验;
2、具有丰富的工程知识,熟悉MLsys包括但不限于Verl、Slime、Megatron等开源框架;熟悉现在的主流Agent框架,是Claude Code/Codex等工具的深度用户,了解Agent工程实现细节和对应模型训练技术;
3、工作主动性、行动力强,目标驱动,交流沟通、团队合作意识强、敢于创新,能迅速熟悉字节跳动内外部平台工具使用,具有主动提升效率的意识。
提示:投递请认准招聘单位官方招聘官网,谨防中介收费。