资深云原生基础设施工程师(Kubernetes/云网络方向)
岗位信息
| 招聘单位 | 波克 |
|---|---|
| 工作地点 | 上海 |
| 官方更新时间 | 2026-01-15 18:01:02 |
职位描述
岗位职责
1. 负责公司云原生基础设施的架构治理、生产运维与稳定性保障,覆盖多云托管 Kubernetes 集群及相关网络、存储、调度、发布和故障恢复能力。
2. 深入负责 Kubernetes 数据面与公有云基础设施,重点建设和治理 CNI、CSI、VPC、负载均衡、DNS、路由、安全组、ENI、NetworkPolicy等能力,解决跨节点、跨可用区及多云环境中的复杂网络与存储问题。
3. 逐步承接业务运维侧的 VPC 网络职责,梳理从公网或内网入口、云 LB、VPC、节点到 Service、CNI及Pod的完整流量路径,建立自主排障和稳定性保障能力。
4. 负责 ACK、TKE、EKS、GKE 等多云托管 Kubernetes 环境的运维、治理与优化,推动集群基线、容量管理、弹性扩缩容、发布回滚和资源治理标准化。
5. 参与游戏业务的部署交付、线上保障和重大活动保障,承担必要的值班及应急响应,在复杂故障中负责核心定位与处置,推动问题复盘和闭环整改。
6. 与平台工程、研发、安全等团队协作,完善监控、告警、日志、Event和链路追踪等排障闭环;推动多集群、安全治理及云原生能力的工程化落地。
7. 沉淀云原生基础设施相关文档、SOP、排障手册和最佳实践,提升团队对云网络、容器网络及存储体系的接管能力。
任职资格
1. 全日制本科及以上学历,计算机相关专业,5 年及以上运维、SRE、平台工程或云原生基础设施经验,具备大型互联网、游戏或高并发业务生产经验。
2. 具备扎实的 Linux 和 TCP/IP 基础,能够独立分析生产环境中的网络、存储、性能及稳定性问题。
3. 具备完整的 Kubernetes 生产实践,熟悉集群运维、资源调度、服务发布、滚动升级、容量规划、故障恢复和性能优化。
4. 深入理解 Kubernetes 网络体系,能够讲清并排查 Pod、Service、kube-proxy或eBPF、Ingress/Gateway、CNI、NetworkPolicy与云 LB 之间的完整流量链路;熟悉 Cilium、Calico、Kube-OVN或云厂商 CNI 中至少一种。
5. 熟悉公有云网络,具备 VPC、子网、路由、安全组/NACL、ENI、负载均衡、对等连接等实际经验;能够从 Kubernetes 配置追踪至云平台控制台或 API 完成问题定位。
6. 熟悉 Kubernetes 存储体系,理解 PV/PVC、StorageClass、动态供给、扩容、快照及备份机制,具备云盘或文件存储 CSI 的生产实践和故障处理经验。
7. 具备至少两类 Kubernetes 环境的生产经验,其中至少一类为 ACK、TKE、EKS或GKE等托管 Kubernetes;能够独立承担相关环境的运维和优化。
8. 具备自动化与工程化能力,熟悉 Shell、Python或Go中的至少一种,有平台治理、运维自动化或基础设施标准化项目经验。
9. 责任意识和风险意识良好,能够参与游戏业务值班、应急响应及重大活动保障。
加分项
1. eBPF、Cilium、Hubble或容器网络性能优化经验。
2. 多集群管理、跨集群服务发现或跨地域部署经验。
3. NetworkPolicy、零信任或与安全团队协同治理经验。
4. AWS EKS、海外业务或游戏行业经验。
5. Service Mesh、Operator、Admission Webhook、GitOps实践。
6. CNCF 项目贡献经历。
7. AI/AI Agent在智能运维、故障分析或平台提效方面的实践。
提示:投递请认准招聘单位官方招聘官网,谨防中介收费。