招聘公告 · 职位检索 · 央国企/事业单位/名企

大模型推理研发专家-基础设施

单位:字节跳动类别:研发类型:社招地点:杭州更新:2026-09-24

岗位信息

招聘单位字节跳动
工作地点杭州
官方更新时间2026-01-14 13:51:45

职位描述

1、负责构建性能领先的LLM推理服务引擎与平台,大模型推理性能优化,参与Servingkit的研发等开发工作;

2、负责LLM推理服务的全链路性能分析、瓶颈定位与优化,能够深入理解大模型推理服务,通过极致的系统优化,在满足SLO/SLA要求的前提下,最大化推理系统的吞吐、降低时延,并实现成本与性能的最佳平衡;

3、负责大模型推理前瞻性技术架构的调研和引入,技术方案不限于编译优化、模型量化等。

任职要求

1、熟练掌握Linux环境下的C/C++与Python语言,有大规模机器学习系统相关经验;

2、熟悉至少一种大模型训练/推理框架,包括但不限于:推理(vLLM、TensorRT-LLM、SGLang等)、机器学习框架(Tensorflow/PyTorch等);

3、具备定位和解决复杂系统性能瓶颈的丰富经验,善于运用各类性能分析工具(Perf、eBPF、Nsight等);

4、优秀的跨团队沟通与协作能力,独立负责并推进大型技术项目。

加分项

1、在主流大模型推理框架(SGlang、vLLM、TensorRT-LLM 等)有深入使用或二次开发经验者优先;

2、理解GPU硬件架构,理解GPU软件栈(CUDA,cuDNN),具备GPU性能分析的经验;

3、对InfiniBand/RDMA网络编程与性能调优有实践经验。

前往官方投递

提示:投递请认准招聘单位官方招聘官网,谨防中介收费。