招聘公告 · 职位检索 · 央国企/事业单位/名企

AI运维工程师

单位:极佳视界类别:互联网 / 电子 / 网游类型:社招地点:北京更新:2026-09-24

岗位信息

招聘单位极佳视界
工作地点北京
官方更新时间2025-07-21 10:54:56

职位描述

职位描述

1.负责公司IDC、公有云(火山云/腾讯云等)的规划、部署、监控与优化,保障业务高可用性(SLA ≥ 99.9%);

2.负责管理公司GPU集群,调配训练平台资源,堡垒机维护,账号入离职权限管理;

3.设计并实施自动化运维体系(Ansible/Terraform/Jenkins等),提升系统部署、监控告警、故障处理效率;

4.维护大规模Linux服务器集群(CentOS/Ubuntu)、Kubernetes/Docker容器平台及中间件(Nginx/MySQL/Redis/CICD等)、大规模数据存储;

5.建立全链路监控体系(Zabbix/Prometheus/Grafana),实时分析系统性能瓶颈,预防潜在风险;

6.制定并执行容灾备份、安全加固及合规策略,响应安全事件;

7.编写运维文档及技术方案,推动DevOps文化落地;

任职要求

职位要求

1.本科及以上学历,计算机/通信相关专业,3-5年科技公司运维经验;

2.具备GPU集群管理经验,了解ROS/ROS2生态;

3.精通Linux系统管理、Shell/Python脚本开发,熟悉TCP/IP、HTTP等网络协议;

4.熟练使用至少一种公有云(火山云/腾讯云/阿里云),有PB级存储搭建经验,具备云资源编排及成本优化经验;

5.掌握容器化技术(Docker/K8s)及CI/CD工具链(GitLab/Jenkins);

6.熟悉监控日志系统(ELK/Prometheus)及自动化运维工具(Ansible/SaltStack)。

加分项:

1.有高并发、分布式系统运维经验者优先;

2.懂桌面运维、熟悉网络安全防护(WAF/防火墙/漏洞扫描);

3.持有AWS/AliCloud/K8s认证证书;

4.有大模型相关基础设施搭建经验;

5.了解Infrastructure as Code(IaC)实践。

前往官方投递

提示:投递请认准招聘单位官方招聘官网,谨防中介收费。