AI大模型算法工程师(LLM/Agent/RL)-集团信息系统
岗位信息
| 招聘单位 | 字节跳动 |
|---|---|
| 工作地点 | 上海 |
| 官方更新时间 | 2026-08-10 21:00:46 |
职位描述
1、探索下一代Agent:研究Agent在复杂长程任务(Long-horizon Tasks)中的能力边界;探索Planning、Memory、Tool Use、Multi-Agent、Proactive Agent等方向;构建面向真实生产环境的大规模Agent系统;
2、大模型后训练(Post-training):基于SFT、Preference Learning、RL(GRPO、PPO等)持续提升模型能力;构建Agent Reward、自动评测体系和训练数据闭环;探索Long Context、Reasoning、Tool Calling等能力优化;
3、AI原生产品算法研发:将LLM技术应用于企业服务场景;探索用户理解、长期记忆、行为建模、个性化等方向;持续提升AI产品的智能化体验;
4、端侧模型与推理优化:探索VLM、LLM在移动端、端侧设备上的部署与优化;持续优化模型推理效率、延迟、成本和用户体验;研究模型压缩、量化、蒸馏等技术。
任职要求
1、扎实的机器学习、深度学习基础;
2、熟悉Transformer、Attention、MoE等主流模型结构;
3、理解LLM的训练流程,包括Pre-training、SFT、RLHF/Post-training;
4、熟悉Python,具备良好的工程能力和代码质量意识;
5、能快速阅读论文并复现最新工作。
加分项(有以下任一经验即可):
1、LLM后训练(SFT、DPO、RL、GRPO等);
2、Agent/Tool Use/MCP/Multi-Agent;
3、训练或推理系统(Megatron、DeepSpeed、vLLM、SGLang等);
4、端侧模型部署(MLX、MNN、TensorRT、ONNX、CoreML等);
5、参与过开源模型训练或发表相关论文。
提示:投递请认准招聘单位官方招聘官网,谨防中介收费。