招聘公告 · 职位检索 · 央国企/事业单位/名企

GPGPU 编译器后端专家/架构师(J10872)

单位:云天励飞类型:社招地点:深圳市、成都市、西安市、上海市、北京市、南京市更新:2026-09-24

岗位信息

招聘单位云天励飞
工作地点深圳市、成都市、西安市、上海市、北京市、南京市
官方更新时间2026-08-12T18:45:37.9536051

职位描述

岗位职责

负责自研 GPGPU 编译器机器后端的设计与优化,包括指令选择、寄存器分配、指令调度、代码生成等核心模块。

建立面向 GPU 架构的指令与资源模型,优化寄存器压力、spill、occupancy、指令流水和延迟隐藏。

负责 Tensor/Matrix 指令、低精度计算、异步数据搬运、同步机制等高级 GPU 特性的编译支持。

与芯片架构、指令集和性能团队协作,推动编译器与硬件的协同设计和性能优化。

基于典型 CUDA Kernel 和 AI 算子分析生成代码质量,定位编译器、指令集及硬件层面的性能问题。

参与编译器架构评审和技术规划,沉淀设计规范、性能分析方法和自动化工具,指导团队提升机器后端能力。

任职要求

任职要求

通常具备 6 年以上编译器后端或处理器工具链开发经验,有复杂模块 Owner 或核心研发经验。

熟悉 LLVM Backend 或同类编译器后端框架,理解 MIR、SelectionDAG、GlobalISel、Register Allocation、Instruction Scheduling 等机制。

深入理解 GPU、SIMT、向量处理器或类似并行处理器体系结构。

实际参与过指令选择、寄存器分配、指令调度、资源模型、spill 优化等至少两个核心模块。

具备性能分析能力,能够结合 IR、反汇编、Benchmark 和硬件性能数据定位问题。

精通 C++,具备良好的系统设计、工程实现和跨团队协作能力。

加分项

有成熟 GPU、GPGPU 或 AI 芯片编译器后端经验。

有芯片预硅验证、A0 Bring-up 或软硬件协同设计经验。

熟悉 CUDA/PTX、Tensor Core、异步流水、GPU 内存与同步模型。

有 LLVM、MLIR、ROCm、Triton、GCC 等开源项目贡献经验。

前往官方投递

提示:投递请认准招聘单位官方招聘官网,谨防中介收费。