Company Dingtalk
Focus Tech · Backend
Location 苏州
Published August 20, 2026
本科及以上学历,计算机相关专业,3 年以上运维或 SRE 相关工作经验。
具备一定的开发能力,熟悉至少一门编程语言(如 Go / Python / Java 等),能够独立开发运维平台或自动化工具,而不仅是脚本编写。
熟悉阿里云核心产品(ECS、SLB、VPC、ACK、RDS、Redis、SLS 等),有较丰富的公有云环境使用与治理经验。
深入理解 Kubernetes 架构与工作原理,具备生产级 K8S 集群的部署、运维与排障经验。
拥有较丰富的线上环境运维经验,熟悉高并发、大规模分布式系统的稳定性保障,有独立处理线上故障的实战能力。
熟悉 Linux 系统与常见中间件,较深入了解阿里云 SLS(日志服务)、阿里云 Prometheus 监控服务及 Grafana,能搭建完善的监控、日志与可观测体系,并有基于其做告警、大盘与运维自动化的实战经验。
具备扎实的网络基础,理解 TCP/IP、DNS、HTTP、负载均衡、VPC/专线等,能定位跨网络链路的性能与连通性问题。
具备良好的成本意识,在方案设计与资源使用中主动考虑投入产出,持续推动降本增效。
对生产环境心存敬畏,严格遵守变更规范,操作谨慎、有风险预判,能对线上安全负责。
具备较强的自主学习能力,能快速上手新技术、新业务;有良好的责任心与推动力,能够独当一面,独立负责模块或项目的落地。 加分项
有自研运维平台、自动化运维体系或稳定性平台的从 0 到 1 建设经验。
熟悉云成本优化(FinOps)、容量规划或资源调度相关实践。
有音视频、RTC、实时通信等大流量业务的运维经验。
熟悉 IaC(Terraform / Helm 等)及 GitOps 工作模式。
有完善监控告警体系的搭建与运营经验,能设计合理的告警策略、降低误报漏报、提升告警有效性。
有 AIOps / 智能运维相关经验,如利用 AI/大模型做异常检测、根因定位、故障预测、智能问答或运维自动化等。
具备开源项目贡献或技术社区影响力。