鱼泡网首页职位公司校园意外险下载APP

登录注册后可以:

直接与老板/牛人联系

更精准匹配求职意向

获取更多的求职信息

站点可靠性工程师(SRE)

2.5-3.5万元/月
职位详情
微信扫码分享
举报
5-10年大专GolangDockerSRE性能优化运维开发/DevOpsPython/Shell运维工程师
职位名称:站点可靠性工程师(SRE) 职位类型: 全职 工作地点: 深圳市南山区 职位描述: 我们正在招募一名站点可靠性工程师(SRE),致力于保障公司核心业务系统的高可用性、高效运行与成本可控。如果你热衷于降低系统故障频率、缩短故障恢复时间、优化性能开销,并对运维自动化、可度量的运维与性能调优有强烈兴趣,欢迎加入我们的技术团队。 主要职责: • 稳定性保障:参与7x24小时高可用架构的设计、落地与持续优化,深度介入系统方案评审,从运维角度输出关于系统稳定性与可维护性的专业建议。 • 故障管理:快速响应并处理线上突发事件,主导故障复盘流程,推动长期未闭环问题的根本解决及自动恢复机制的建设,有效压缩平均修复时长(MTTR)。 • 效率提升:主导自动化运维平台与工具的研发与迭代,覆盖发布部署、监控告警、故障自愈等关键场景,减少人工干预,提升整体运维效率。 • 成本与性能优化:持续跟踪系统资源使用情况,定位性能瓶颈与资源浪费环节,通过架构优化、参数调整、调度策略改进等方式实现系统性能提升与成本节约。 • 度量驱动:搭建并完善服务等级指标(SLI)与目标(SLO)体系,依托监控数据、链路追踪和日志分析进行决策支持,量化呈现系统健康状态与故障影响范围。 • 文档与知识沉淀:撰写技术文档、操作手册及最佳实践指南,主动在团队内分享经验与成果,推动组织能力的整体提升。 职位要求: • 学历经验: 大专及以上学历,计算机相关专业背景。 具备5年以上SRE/DevOps/高级运维岗位实践经验。 拥有至少一个完整项目的DevOps全流程落地经历。 • 技术能力: 熟悉Linux操作系统原理,具备扎实的系统调试与问题排查能力。 熟练掌握至少一门编程语言(Python/Shell/Go),能够独立开发运维类工具或平台。 理解CI/CD核心理念,熟练运用Jenkins、GitLab CI等工具构建和维护持续集成与交付流水线。 精通至少一种配置管理工具(Ansible/SaltStack/Puppet)以及容器化技术(Docker/K8s)。 具有丰富的监控系统(如Prometheus、Zabbix、Grafana)建设经验,能独立设计并实施端到端的监控告警方案。 对系统级性能调优(网络、数据库、中间件、JVM等)有实际项目经验并保持持续探索热情。 加分项: 具备大型云平台(AWS/CloudFlare/GCP)运维及成本治理经验者优先考虑。 有完整性能优化项目经历或运维指标体系建设案例者优先。 曾主导重大故障复盘并推动系统性改进者优先。 了解混沌工程理念并有实践尝试者优先。 对自动化有极致追求,有开源社区贡献或运营技术博客者优先。 我们提供: 深圳全额缴纳五险一金,配备补充重疾保险。 标准双休制度,执行加班调休与补贴政策。 岗位属于成熟业务线的扩展运维需求,将深度参与科技金融领域高并发、高可用系统的运维工作,具备良好的成长空间与发展前景。

职位总结围绕职位描述,归纳工作内容、招聘要求

郑女士IP:广东深圳

威尔

·人事经理
工商信息

法定代表人:

王钦华

成立日期:

2021-08-09

查看全部

工作地址
深圳南山区深圳市南山区粤海街道高新中二道2号深圳软件园6栋1单元B509
点击查看地图

深圳

搜索

各大行业职位任你选

首次验证通过即注册鱼泡直聘账号

获取验证码
已阅读并同意
《隐私政策》《服务协议》
登录/注册
请选择城市
热门城市ABCDEFGHJKLMNPQRSTWXYZ
全国