AI runtime工程师
岗位信息
| 招聘单位 | 蔚来 |
|---|---|
| 工作地点 | 上海、合肥 |
| 经验要求 | 5 |
| 官方更新时间 | 2025-05-27 14:18:15 |
职位描述
负责开发深度学习AI模型的runtime软件,完成计算资源调度、内存管理、host-device并行优化工作。
1,分析和解决KMD/UMD的功能、性能和稳定性问题,确保高质量交付AI系统的运行时软件;
2,与编译器、驱动工程师协同提供定制优化项和编程api;
3,参与故障检测和恢复机制设计,保证AI系统的可靠性;
4,参与Profiling工具设计,保证AI系统的性能可视化和瓶颈定位;
5,持续改进通信和调度机制, 与业务团队协作完成多模型部署,提高芯片的综合计算效率和系统吞吐量;
任职要求
1,计算机、通信或者电子相关专业,本科及以上学历,有AI芯片系统软件开发或验证经验者优先;
2,熟悉NPU/GPGPU体系结构,深入理解ROCm/Cuda Runtime项目;
满足以下条件优先:
1,熟悉AI系统的运行时开发;
2,熟悉集群通信的原理和实现,包括MPI,NCCL等通信库。
熟悉AI推理引擎运行机制,理解Pytorch Aten,Executorch,TVM Runtime
提示:投递请认准招聘单位官方招聘官网,谨防中介收费。