招聘公告 · 职位检索 · 央国企/事业单位/名企

全栈云端计算平台工程师

单位:小鹏汽车类别:互联网 / 电子 / 网游类型:社招地点:广州更新:2026-09-24

岗位信息

招聘单位小鹏汽车
工作地点广州
官方更新时间2026-05-29 18:32:38

职位描述

职位描述

1. 负责小鹏集团计算平台的架构设计与研发落地,构建云端模型开发,训练基础设施以及大规模数据生产基础设施;

2. 设计并实现高性能数据编排与加载系统,支撑 PB 级多模态数据(文本、图像、视频、点云、传感器等)的高效处理、缓存加速,支持批式与流式数据生产;深度集成AI Coding Agent与 Data Pipeline,实现数据准备、清洗、标注、版本管理的自动化与智能化闭环;

3. 负责云原生基础设施层的开发与优化,包括 GPU集群调度、弹性资源管理、容器化训练/推理工作负载编排,持续提升资源利用率与系统吞吐;

4. 可以承担全栈职责,包括前端管理控制台到后端分布式服务的开发。

职位要求

1. 计算机 / 软件工程 / 数学 / 自动化等相关专业硕士及以上学历,或具备同等技术能力;3 年及以上后端/基础设施开发经验,其中 2 年及以上大规模 AI 平台或分布式系统研发经验;

2. 精通Python,具备出色的工程化能力;熟练使用 Golang/Java/C++ 中至少一门语言进行系统性开发;

3. 熟悉 AI Coding / AI Agent 相关工具体系,日常使用 Copilot / Cursor / Claude Code / Codex CLI 等辅助开发,了解 Agentic Coding 工作流(MCP 协议、Function Calling、Sandbox 执行等),能将其融入平台工程实践;

4. 具备完整全栈能力:熟悉至少一个前端框架(React / Vue),能独立开发管理控制台、可视化监控面板等前端界面;

5. 云原生与分布式系统:深入掌握 Kubernetes 编排(Pod/Job/CRD/Operator);

6. 优秀的跨团队沟通与协作能力,Owner 意识强,善于在模糊需求中定义问题、拆解路径并推动落地。

加分项

1. 有 AI Infra 开源项目贡献经历(如 vLLM、Triton、Ray、Kubeflow、Volcano、Fluid 等),或维护过有一定 Star 数的后端/基础设施项目;

2. 熟悉模型训练/推理全流程——分布式训练策略(FSDP/DeepSpeed/Megatron)、GPU 显存优化(FlashAttention/PagedAttention)、推理加速(TensorRT/vLLM/SGLang);

3. 对以下任一领域有深入理解:

a. 数据仓库与数据湖体系(Hadoop/Hive/Spark/Flink/Iceberg);

b. 高性能计算网络(RDMA/RoCE/InfiniBand)及集合通信库(NCCL/RCCL);

4. 掌握关系型数据库(PostgreSQL/MySQL)与 NoSQL(Redis/MongoDB/Elasticsearch);

5. 熟悉至少一种流/批处理引擎(Spark/Flink/Ray Data),理解数据分区、Shuffle、Checkpoint 等机制;

6. 熟悉数据加载与预处理管线,熟悉 Parquet/lance 列式存储及向量化读取优化.

前往官方投递

提示:投递请认准招聘单位官方招聘官网,谨防中介收费。