到岗时间:不限
婚况要求:不限
作职责:
1) 确保业务高可用:设计和实施具有弹性的系统架构,识别并解决潜在的单点故障,制定应急响应计划,迅速恢复服务,确保用户无障碍访问。
2) 事故处理:主导解决影响业务的高优先级事故的服务器和存储类型事故
3) 提高运维效率:编写脚本、工具或基础设施代码,实现自动化部署、监控、日志分析等操作,减少手动操作,自动化重复性任务,确保持续交付和集成。
4) 系统性能优化:进行系统性能分析,优化代码和基础设施,制定扩展计划,确保系统能够适应业务的快速增长,在高负载下仍能保持稳定。
5) 安全合规管理:设计和实施安全策略,监测潜在威胁,参与安全审计和合规性检查,确保系统的安全性和数据隐私,符合法规和公司政策要求。
6) 搭建智能运维平台AIOps: 将人工智能与大数据技术整合到IT运维中的系统性解决方案,旨在通过机器学习、自然语言处理等技术实现运维自动化、故障预测与智能决策,推动运维管理从被动响应向主动预防升级。
岗位要求:
1)统招本科以上学历,5年以上工作经验;
2)扎实的计算机软件基础知识; 熟悉 Linux 操作系统、存储、网络 IO 等相关原理;
熟悉云计算平台:如AWS、Azure、Google Cloud等,了解这些平台的服务、架构和最适合的实践。
编程与自动化能力:熟练掌握Python、Go、Java等编程语言,以及Shell脚本、Ansible、Terraform等自动化工具和脚本编写。
系统监控与日志分析:熟练使用Prometheus、Grafana、ELK Stack等监控和日志分析工具,实时监控系统状态,快速定位问题。
容器与微服务架构:了解Docker、Kubernetes等容器化技术,以及服务发现、负载均衡、服务网格等微服务架构相关知识。
求职提醒:求职过程请勿缴纳费用,谨防诈骗!若信息不实请举报。