AI算子工程师
岗位信息
| 招聘单位 | 新紫光集团前沿技术研究院 |
|---|---|
| 工作地点 | 天津、海口、成都 |
| 官方更新时间 | 2025-05-14 09:16:07 |
职位描述
1. 负责AI算法算子的高性能实现与优化,针对深度学习模型(如CNN、Transformer、GNN等)的核心算子(如卷积、矩阵乘、Attention、稀疏计算)进行硬件适配及加速;
2. 基于CUDA/OpenCL/Triton等开发工具,实现GPU/TPU/ASIC等硬件平台的高效算子库,优化计算、内存带宽及功耗效率;
3. 与算法团队协作,针对模型特性设计定制化算子(如融合算子、动态shape支持),提升端到端推理/训练性能;
4. 开发量化、稀疏化、混合精度等模型压缩技术的底层算子实现,确保精度与性能的平衡;
5. 构建算子性能分析工具链,支持算子级Benchmark(如FLOPs、延迟、吞吐)及硬件资源利用率调优;
6. 跟踪AI硬件前沿技术(如Tensor Core、NPU指令集、存算一体架构),探索新型算子的硬件友好实现方案。
任职要求
1. 硕士及以上学历,计算机科学、电子工程、数学、人工智能等相关专业;
2. 3年以上AI算子开发经验,熟悉PyTorch/TensorFlow等框架的底层算子实现机制;
3. 精通以下至少一个领域的开发与优化:
1. GPU加速:CUDA/OpenCL编程,熟悉TensorRT/TVM/Triton等工具链;
2. 专用硬件:NPU/ASIC/DSP的指令集优化、内存布局设计、流水线调度;
3. 高性能计算:SIMD/多线程优化、缓存优化、算法并行化;
4. 深入理解AI模型计算特性:
1. 熟悉常见算子计算图(如GEMM、Conv、Reduce)的算法与硬件映射;
2. 掌握模型压缩技术(如INT8量化、稀疏剪枝)的底层实现原理;
5. 熟悉计算机体系结构,具备硬件/算法协同设计经验者优先;
6. 具备优秀的代码能力(C++/Python),熟悉LLVM/MLIR等编译技术者加分;
7. 对技术有热情,具备跨团队协作能力,能快速定位性能瓶颈并提出创新解决方案。
提示:投递请认准招聘单位官方招聘官网,谨防中介收费。