招聘公告 · 职位检索 · 央国企/事业单位/名企

AI算子工程师

单位:新紫光集团前沿技术研究院类别:电子 / 半导体类型:社招地点:天津、海口、成都更新:2026-09-24

岗位信息

招聘单位新紫光集团前沿技术研究院
工作地点天津、海口、成都
官方更新时间2025-05-14 09:16:07

职位描述

1. 负责AI算法算子的高性能实现与优化,针对深度学习模型(如CNN、Transformer、GNN等)的核心算子(如卷积、矩阵乘、Attention、稀疏计算)进行硬件适配及加速;

2. 基于CUDA/OpenCL/Triton等开发工具,实现GPU/TPU/ASIC等硬件平台的高效算子库,优化计算、内存带宽及功耗效率;

3. 与算法团队协作,针对模型特性设计定制化算子(如融合算子、动态shape支持),提升端到端推理/训练性能;

4. 开发量化、稀疏化、混合精度等模型压缩技术的底层算子实现,确保精度与性能的平衡;

5. 构建算子性能分析工具链,支持算子级Benchmark(如FLOPs、延迟、吞吐)及硬件资源利用率调优;

6. 跟踪AI硬件前沿技术(如Tensor Core、NPU指令集、存算一体架构),探索新型算子的硬件友好实现方案。

任职要求

1. 硕士及以上学历,计算机科学、电子工程、数学、人工智能等相关专业;

2. 3年以上AI算子开发经验,熟悉PyTorch/TensorFlow等框架的底层算子实现机制;

3. 精通以下至少一个领域的开发与优化:

1. GPU加速:CUDA/OpenCL编程,熟悉TensorRT/TVM/Triton等工具链;

2. 专用硬件:NPU/ASIC/DSP的指令集优化、内存布局设计、流水线调度;

3. 高性能计算:SIMD/多线程优化、缓存优化、算法并行化;

4. 深入理解AI模型计算特性:

1. 熟悉常见算子计算图(如GEMM、Conv、Reduce)的算法与硬件映射;

2. 掌握模型压缩技术(如INT8量化、稀疏剪枝)的底层实现原理;

5. 熟悉计算机体系结构,具备硬件/算法协同设计经验者优先;

6. 具备优秀的代码能力(C++/Python),熟悉LLVM/MLIR等编译技术者加分;

7. 对技术有热情,具备跨团队协作能力,能快速定位性能瓶颈并提出创新解决方案。

前往官方投递

提示:投递请认准招聘单位官方招聘官网,谨防中介收费。