后端开发工程师(J23395)
岗位信息
| 招聘单位 | 神州数码 |
|---|---|
| 工作地点 | 上海市 |
| 官方更新时间 | 2026-08-11T09:25:11 |
职位描述
岗位使命:
使用 Python/Flask/SQLAlchemy 构建可扩展、高可用的平台后端,开发 Kubernetes Scheduler/Controller/Operator,实现混合云 CPU/GPU、存储、网络、模型和 AI 资产的全生命周期管理。
核心职责:
· Python + Flask 微服务开发,设计、实现并优化 RESTful API。
· 使用 SQLAlchemy 管理 PostgreSQL/MySQL 等关系数据库的事务一致性与高性能查询。
· 开发 Kubernetes Custom Scheduler、Controller 和 Operator,调度本地裸金属与 AWS/阿里云 CPU/GPU 资源。
· 实现对象/块存储挂载、容器运行时、网络路由及 Istio Gateway 流量管理。
· 集成 Kubeflow、Seldon Core、vLLM 等 AI 原生组件。
· 增强模型注册库、数据集、特征库、容器镜像和资源生命周期模块。
· 接入分布式日志/追踪/指标、节点注册、监控告警与运维管理。
· 参与架构优化、安全审查、自动化测试、上线及复杂故障排查。
任职要求
任职硬性要求:
· 5–7+年后端和分布式系统开发经验,精通 Python、Flask/FastAPI 和 REST API。
· 3+年 AI 基础设施、MLOps、云原生调度或大规模数据管道经验。
· 具备 Kubernetes API、CRD、Operator/Controller 开发经验。
· 熟悉 PostgreSQL/MySQL、ORM、事务、索引和性能调优。
· 理解 Linux、容器、网络、存储、IAM/RBAC 及 CI/CD。
· DevOps Toolsets Integration、CI/CD、Infrastructure、Linux OS Administration、专业英文写作和 Markdown 文档能力为基础要求。
· 熟悉 Agile/DevOps、ITIL、SDLC、Incident/Problem/Change Management 和全球团队协作。
优先条件:
· 有 GPU 调度、SLURM/Celery、Istio、Kubeflow、Seldon、vLLM 实战。
· 有模型注册、特征库、向量库或多租户 MaaS 经验。
· 有医药、高合规或混合云平台经验。
提示:投递请认准招聘单位官方招聘官网,谨防中介收费。