资深系统运维工程师
Company Mihoyo
Focus Tech · Backend
Location 上海
Published January 7, 2026
岗位职责
- 负责 P4 及内网 CDN 全链路稳定性,涵盖架构优化、容量规划、缓存一致性、DNS 调度、版更保障及故障处置。
- 负责物理机自动化交付与运维,包括裸金属批量装机(Ironic/PXE/Kickstart 等)、镜像标准化、装机流程优化及上架/搬迁/回收等生命周期管理。
- 负责 KVM 虚拟化平台及计算资源池的稳定运行,涵盖虚拟机创建与调度、存储/网络配置、资源容量规划、性能调优、高可用保障及故障排查;支撑打包机、构建环境、测试环境等虚拟化 workloads 的稳定交付。
- 负责硬件资源全生命周期与成本管理,涵盖服务器/网络设备等资产的纳管、交付、变更、调拨、退役及 CMDB 维护;统筹各项目组硬件需求对接、资源分配与利用率治理;参与年度/季度预算编制、采购需求评审、成本分析与优化,推动费用分摊、账单核对及预算执行跟踪等流程规范化。
- 负责运维自动化建设,用 Go/Python 开发工具与平台模块,协助业务团队解决下载、分发、资源交付及中间件相关痛点。
任职要求
- 本科及以上学历,计算机相关专业,5 年以上系统运维 / SRE 经验。
- 深入理解 CDN 原理(缓存、回源、预热、一致性),有自建或内网 CDN 生产运维经验,能独立排查复杂下载链路问题。
- 了解 P4 或类似版本管理系统的部署与下载链路,有大包分发、构建产物下发经验者优先。
- 具备物理机批量自动化装机经验,熟悉裸金属交付流程(如 Ironic、PXE、Kickstart/Cloud-init、Packer 镜像构建等至少一种),了解 UEFI/PXE 启动、分区、网络初始化及装机异常排查。
- 熟悉 KVM/QEMU 虚拟化原理及生产运维,具备虚拟机的创建、资源调度、存储/网络配置、性能调优及故障排查能力;有 OpenStack、libvirt 或大规模虚拟化平台经验者优先。
- 具备大规模硬件资源与成本管理经验,熟悉服务器/网络设备从采购交付到退役的全流程及 CMDB 资产治理;参与过硬件/云资源/带宽等预算编制、费用分摊、账单核对、成本分析与资源利用率优化。
- 熟练掌握 Golang 或 Python,能独立开发自动化工具及运维平台模块,有 Prometheus、Grafana 等监控系统的使用或建设经验,了解指标采集、告警配置及 SLO 制定。
- 具备较强的抗压与 Owner 意识,重视流程、规范与文档,能写规划、做复盘,有良好的沟通协调能力和团队合作精神。