招聘公告 · 职位检索 · 央国企/事业单位/名企

后端开发工程师(J23395)

单位:神州数码类型:社招地点:上海市更新:2026-09-24

岗位信息

招聘单位神州数码
工作地点上海市
官方更新时间2026-08-11T09:25:11

职位描述

岗位使命:

使用 Python/Flask/SQLAlchemy 构建可扩展、高可用的平台后端,开发 Kubernetes Scheduler/Controller/Operator,实现混合云 CPU/GPU、存储、网络、模型和 AI 资产的全生命周期管理。

核心职责:

· Python + Flask 微服务开发,设计、实现并优化 RESTful API。

· 使用 SQLAlchemy 管理 PostgreSQL/MySQL 等关系数据库的事务一致性与高性能查询。

· 开发 Kubernetes Custom Scheduler、Controller 和 Operator,调度本地裸金属与 AWS/阿里云 CPU/GPU 资源。

· 实现对象/块存储挂载、容器运行时、网络路由及 Istio Gateway 流量管理。

· 集成 Kubeflow、Seldon Core、vLLM 等 AI 原生组件。

· 增强模型注册库、数据集、特征库、容器镜像和资源生命周期模块。

· 接入分布式日志/追踪/指标、节点注册、监控告警与运维管理。

· 参与架构优化、安全审查、自动化测试、上线及复杂故障排查。

任职要求

任职硬性要求:

· 5–7+年后端和分布式系统开发经验,精通 Python、Flask/FastAPI 和 REST API。

· 3+年 AI 基础设施、MLOps、云原生调度或大规模数据管道经验。

· 具备 Kubernetes API、CRD、Operator/Controller 开发经验。

· 熟悉 PostgreSQL/MySQL、ORM、事务、索引和性能调优。

· 理解 Linux、容器、网络、存储、IAM/RBAC 及 CI/CD。

· DevOps Toolsets Integration、CI/CD、Infrastructure、Linux OS Administration、专业英文写作和 Markdown 文档能力为基础要求。

· 熟悉 Agile/DevOps、ITIL、SDLC、Incident/Problem/Change Management 和全球团队协作。

优先条件:

· 有 GPU 调度、SLURM/Celery、Istio、Kubeflow、Seldon、vLLM 实战。

· 有模型注册、特征库、向量库或多租户 MaaS 经验。

· 有医药、高合规或混合云平台经验。

前往官方投递

提示:投递请认准招聘单位官方招聘官网,谨防中介收费。