到岗时间:不限
婚况要求:不限
工作描述:
1、负责整体核心业务稳定性,制定SRE故障处理流程和灾备预案,协助组织日常故障处理、复盘等工作
2、负责SRE系统等工具/平台建设,如metrics、tracing、logging、sentry等
3、通过持续的全方位数据运营(包括可用性指标、历史事故、资源利用率等),找到系统薄弱点,落地地改进项目
4、持续提升系统自动化运维能力,将运维技术能力产品化,降低人工依赖
任职要求:
1、3年以上SRE相关工作经验,较强的跨团队协作能力,有团队管理经验优先
2、熟练使用Linux/unix操作系统,精通Shell编程,并熟练掌握golang、java、Python之一的编程
3、工作积极主动、善于思考总结,有很强的问题分析和推进解决能力
4、熟悉Docker/k8s容器平台及相关的底层技术和原理者优先
求职提醒:求职过程请勿缴纳费用,谨防诈骗!若信息不实请举报。