招聘公告 · 职位检索 · 央国企/事业单位/名企

2027届-AI 存储固件工程师(大模型推理方向)(J11580)

单位:江波龙类型:校招地点:上海市更新:2026-09-24

岗位信息

招聘单位江波龙
工作地点上海市
官方更新时间2026-09-21T15:54:59

职位描述

1. 参与 LLM 推理与本地存储的软硬件协同优化,主要面向 vLLM / SGLang / llama.cpp 等主流推理框架。

2. 负责大模型推理过程中的数据分层调度,包括但不限于:KV Cache 在内存 ↔ SSD 之间的换入换出与预取策略;MoE 专家权重 / 稀疏模型参数的按需加载与冷热分层。

3. 分析推理过程中的存储 I/O 瓶颈(NVMe 带宽、PCIe、块设备 I/O 路径),并将上层负载特征转化为对 SSD 固件的功能与性能需求。

4. 在端侧场景(NPU + 本地 UFS / NVMe SSD)进行方案原型验证与性能调优。

任职要求

1. 2027 届硕士/博士,计算机、电子、微电子等相关专业。

2. 扎实的 C/C++ 功底,熟悉 Linux 开发环境与基本性能分析工具。

3. 深入理解 Transformer 架构及推理流程(Attention、KV Cache 原理、GQA/MQA 等)。

4. 有 vLLM、SGLang 或 llama.cpp 任一框架的部署 / 调优 / 源码阅读经验。

5. 了解模型量化基本原理。

【加分项(满足任意一条即可)】

1. 有 KV Cache Offload、MoE 专家权重卸载(Expert Offloading)、模型权重分层加载(mmap / streaming load)等相关项目或论文经验。

2. 了解 NVMe 协议、Linux 块设备 I/O 栈或 SPDK / io_uring 等存储优化技术。

3. 有 SSD 固件、FUSE 或存储中间件开发 / 实习经验。

4. 在 OSDI / ATC / FAST / ISCA / MICRO 等系统或体系结构会议发表论文,或对上述开源框架有 PR 记录。

熟悉端侧 NPU / 移动 SoC 的推理部署。

前往官方投递

提示:投递请认准招聘单位官方招聘官网,谨防中介收费。