招聘公告 · 职位检索 · 央国企/事业单位/名企

AI存力芯片工程师(校招)(J10186)

单位:得一微电子类型:校招地点:深圳市更新:2026-09-24

岗位信息

招聘单位得一微电子
工作地点深圳市
官方更新时间2026-09-20T11:02:33

职位描述

负责Transformer大模型在AI芯片端的推理优化与落地,包括模型量化(INT4/INT8)、稀疏化、算子融合、内存复用等核心技术攻关。

参与AI推理框架(如MindSpore、vLLM、TensorRT-LLM等)的开发与适配,完成大模型pipeline的编写、优化与稳定性保障。

对接芯片硬件架构,分析Transformer模型的访存与算力瓶颈,提出硬件友好的算法优化方案。

主导多模块协同开发与跨部门协作,确保大模型推理项目在端侧/边缘设备上的高效交付与性能达标。

持续跟踪AI推理与芯片技术前沿,迭代优化大模型在硬件平台上的推理速度与稳定性。

任职要求

任职要求

(一)核心硬性要求

底层能力:精通Transformer底层原理,深入理解自注意力机制、多头注意力等核心模块,能从数学与工程层面分析大模型推理瓶颈。

工程经验:具备3年及以上大模型推理优化或AI芯片算子开发经验,有端侧/边缘设备部署实战案例。

技术栈:熟悉至少一种主流AI推理框架(MindSpore/PyTorch/TensorRT),掌握模型量化、稀疏化、算子优化等落地技术;了解NPU/GPU硬件架构优先。

编码能力:熟练使用C++/Python进行工程开发,能独立完成推理pipeline的编写与调试。

(二)优先条件

有云天励飞、地平线、安菲翁等AI芯片/大模型公司工作经验者优先。

参与过千亿级参数大模型推理优化或AI芯片流片项目者优先。

熟悉RISC-V架构、CUDA/TVM算子开发、容器化部署(Docker/K8s)者优先。

前往官方投递

提示:投递请认准招聘单位官方招聘官网,谨防中介收费。