AI存力芯片工程师(校招)(J10186)
岗位信息
| 招聘单位 | 得一微电子 |
|---|---|
| 工作地点 | 深圳市 |
| 官方更新时间 | 2026-09-20T11:02:33 |
职位描述
负责Transformer大模型在AI芯片端的推理优化与落地,包括模型量化(INT4/INT8)、稀疏化、算子融合、内存复用等核心技术攻关。
参与AI推理框架(如MindSpore、vLLM、TensorRT-LLM等)的开发与适配,完成大模型pipeline的编写、优化与稳定性保障。
对接芯片硬件架构,分析Transformer模型的访存与算力瓶颈,提出硬件友好的算法优化方案。
主导多模块协同开发与跨部门协作,确保大模型推理项目在端侧/边缘设备上的高效交付与性能达标。
持续跟踪AI推理与芯片技术前沿,迭代优化大模型在硬件平台上的推理速度与稳定性。
任职要求
任职要求
(一)核心硬性要求
底层能力:精通Transformer底层原理,深入理解自注意力机制、多头注意力等核心模块,能从数学与工程层面分析大模型推理瓶颈。
工程经验:具备3年及以上大模型推理优化或AI芯片算子开发经验,有端侧/边缘设备部署实战案例。
技术栈:熟悉至少一种主流AI推理框架(MindSpore/PyTorch/TensorRT),掌握模型量化、稀疏化、算子优化等落地技术;了解NPU/GPU硬件架构优先。
编码能力:熟练使用C++/Python进行工程开发,能独立完成推理pipeline的编写与调试。
(二)优先条件
有云天励飞、地平线、安菲翁等AI芯片/大模型公司工作经验者优先。
参与过千亿级参数大模型推理优化或AI芯片流片项目者优先。
熟悉RISC-V架构、CUDA/TVM算子开发、容器化部署(Docker/K8s)者优先。
提示:投递请认准招聘单位官方招聘官网,谨防中介收费。