模型部署工程师
岗位信息
| 招聘单位 | 上海西井科技股份有限公司 |
|---|---|
| 工作地点 | 上海 |
| 官方更新时间 | 2025-05-13 15:25:04 |
职位描述
1. 深入研究模型压缩与优化前沿技术,持续探索并跟进如 TensorRT、ONNX Runtime、OpenVINO 等不同深度学习推理和加速框架的最新进展,通过模型剪枝、量化、蒸馏等技术手段,实现模型轻量化与性能优化,提升模型在各类硬件平台上的推理效率;
2. 负责感知、规划、端到端无人驾驶等深度学习算法在嵌入式设备、边缘计算平台(OrinX, J6等)及云端服务器的全流程部署工作,包括环境搭建、模型转换、性能调优,确保算法在实际应用场景中高效、稳定运行;
3. 与算法研发团队紧密协作,参与 AI 模型的设计与开发阶段,从部署可行性角度提供专业建议,推动算法模型与工程实践的深度融合;
4. 针对部署过程中出现的问题,进行系统性的故障排查与性能分析,提出有效的解决方案,保障 AI 系统的可靠性与稳定性。同时,积极关注行业动态,探索新的技术和方法,为公司 AI 项目的持续优化提供技术支持。
任职要求
1. 教育背景:计算机科学与技术、电子信息、人工智能等相关专业本科及以上学历;
2. 编程能力:具备扎实的 C++、Python 开发能力,能够熟练运用两种语言进行复杂业务逻辑的实现与系统开发;
3. 深度学习框架:熟练掌握 Pytorch 深度学习框架,熟悉其底层原理与高级特性,能够灵活运用框架实现模型的训练、调试与部署;
4. 技术实践:精通深度学习模型的蒸馏、剪枝、量化等优化技术,拥有实际项目开发经历,能够将理论知识应用于实践,解决实际工程问题;
5. 加分项:具备 CUDA 开发经验,能够充分发挥 GPU 并行计算能力,加速模型推理;拥有 Transformer 相关深度学习模型部署经验,熟悉其架构特点与部署要点者优先考虑;
6. 其他能力:具备良好的团队协作精神、沟通能力和问题解决能力,能够在跨部门协作中高效推进项目;对新技术保持敏锐的洞察力和学习热情,能够快速掌握并应用新兴的 AI 部署技术。
提示:投递请认准招聘单位官方招聘官网,谨防中介收费。