推理Infra开发工程师,系统及infra模块
岗位信息
| 招聘单位 | 商汤科技 |
|---|---|
| 工作地点 | 北京、上海 |
| 官方更新时间 | 2026-06-23 12:58:04 |
职位描述
1. 参与大模型推理平台(LLM Inference Platform)的研发与优化,建设高性能、高可用的推理基础设施。
2. 参与推理引擎、推理调度、资源管理等核心模块开发,持续优化系统性能、稳定性和资源利用率。
3. 参与大规模 GPU 集群的资源调度与服务部署的开发。
4. 参与核心系统架构设计、技术方案评审及工程规范建设。
5. 跟踪 AI Infra、推理引擎及云原生领域新技术,并推动工程实践。
任职要求
1. 后端或基础设施相关开发经验,对分布式系统有基础理解。
2. 熟悉 Go 或 Rust 中至少一种语言,理解并发 / 异步编程模型。
3. 了解 HTTP / RPC / 服务治理 等基础概念,具备良好的代码规范意识。
4. 熟悉 Kubernetes 基本使用,理解容器化与基础资源调度逻辑。
5. 具备良好的学习能力与协作意识,能按文档规范推进任务闭环。
6. 熟练使用AI工具进行开发,测试,运维的能力,包括但不限于Claude Code、Cursor、Codex,月Token消耗量在1B以上。
进阶 / 高级能力(满足其一即可)
1. 有复杂系统或基础设施模块的设计与演进经验(如网关、调度、平台服务)。
2. 对 推理性能优化、资源利用率、系统稳定性 有实际实践或强烈兴趣。
3. 能独立拆解问题、推动技术方案落地,并参与系统性复盘。
加分项
1. 有 LLM 推理系统 相关经验(如 vLLM、Triton、TGI、Ray Serve 等)。
2. 向 开源基础设施项目(如 vLLM、Envoy、K8s 生态)提交过 PR 或技术方案。
3. 有跨栈优化经验(从服务层到通信、调度甚至硬件相关)。
4. 发布过技术博客、Benchmark 报告或系统设计总结。
提示:投递请认准招聘单位官方招聘官网,谨防中介收费。