招聘公告 · 职位检索 · 央国企/事业单位/名企

集合通信库开发工程师

单位:北京清微智能类型:校招地点:上海市更新:2026-09-24

岗位信息

招聘单位北京清微智能
工作地点上海市
官方更新时间2026-09-21T13:37:35

职位描述

1.集合通信库开发与优化

参与 AI 加速器/GPU/NPU 集合通信库的设计与开发,学习并实现 AllReduce、AllGather、ReduceScatter 等集合通信原语,持续优化通信性能。

2.Scale-up 高速互联通信优化

参与多 GPU/NPU 高速互联通信架构及通信路径优化,研究不同硬件拓扑下的数据传输方式,探索拓扑感知、链路调度和带宽利用率优化等技术。

3.通信 Runtime 与底层系统协同开发

参与集合通信 Runtime、设备内存管理及 Driver 相关功能开发,深入学习 P2P、DMA、GPU Direct RDMA(GDR)、GPU Direct Async(GDA)等技术,优化设备间数据传输路径和通信效率。

4.高性能通信问题分析与性能调优

参与通信性能分析、问题定位及优化工作,通过 Profiling、性能建模、实验分析等方式,定位通信瓶颈并持续提升系统性能。

任职要求

1.计算机、软件工程、电子信息、自动化、人工智能等相关专业,本科及以上学历,2027 届及以后毕业生优先。

2.熟悉 C/C++,具备良好的数据结构、操作系统、计算机网络等基础知识,有 Linux 环境下开发经验。

3.对以下一个或多个方向有学习或实践经验:

●CUDA / HIP / GPU Runtime

●RDMA / RoCE / InfiniBand

●PCIe P2P

4.了解集合通信基本原理,对 AllReduce、AllGather、ReduceScatter 等通信操作有一定了解。

5.对 GPU/NPU、AI 加速器、高性能计算、分布式系统、AI Infra、系统软件等方向具有浓厚兴趣,愿意深入学习底层软硬件协同技术。

6.具备良好的问题分析和学习能力,能够通过源码阅读、实验验证、性能分析等方式解决复杂技术问题。

加分项

●有 NCCL、HCCL、MPI、UCX 等通信框架学习、源码分析或项目实践经验;

●有 CUDA / HIP / ROCm / GPU Runtime 开发经验;

●有 RDMA、RoCE、InfiniBand、PCIe、DMA 等相关实践经验;

●有分布式训练、LLM、MoE、Attention 等 AI 模型相关实践经验。

前往官方投递

提示:投递请认准招聘单位官方招聘官网,谨防中介收费。