AMAZING RESUME
牛敬业
自动化运维工程师
188****9778niu****@***.com北京30男自动化运维工程师在职北京25k-35k 北京航空航天大学 - 本科985工程211工程双一流
2013.09-2017.06
•深入理解计算机组成原理、操作系统、数据结构与算法,掌握硬件与系统协同工作机制,为自动化运维打下扎实根基。
•加入智能车竞赛团队,负责嵌入式控制程序开发,使用 C 语言实现自动循迹与避障逻辑,并用 Python 采集传感器数据、分析行驶性能,在实践中锻炼了系统调试与自动化控制能力。
北京智联未来科技有限公司 - 运维部互联网科技创新型企业
2017.07-2020.12
•负责公司电商平台与内部系统的自动化运维,利用 SaltStack 编写状态模块,对 150+ 台服务器进行统一配置与批量管理,将日常巡检由人工 3 小时压缩至 20 分钟,效率提升 89%。
•基于 Zabbix 搭建了全链路监控体系,自定义监控项与告警模板,实现对业务接口、数据库、中间件等核心指标的实时采集,故障平均发现时间从 15 分钟降至 2 分钟。
•开发了一套基于 Python 的自动化健康检查工具,集成邮件与钉钉通知,定期扫描磁盘、内存、服务状态,提前预警潜在风险,使非计划停机次数降低 60%。
北京数智基石网络技术有限公司 - 运维研发部大型互联网企业技术领先
2021.01-至今
•带领 5 人团队推动公司云原生转型,将核心业务迁移至自建 Kubernetes 集群,借助 Helm 与 Kustomize 实现应用标准化交付,资源利用率提升 50%,发布效率提高 70%。
•设计并落地 GitOps 驱动的 CI/CD 流水线,以 GitLab CI 和 ArgoCD 为引擎,实现从代码提交到生产环境全自动灰度发布,部署时间从 3 小时缩短至 20 分钟,回滚风险极大降低。
•构建了轻量级日志处理方案,采用 Loki + Promtail 替代传统 ELK,削减存储成本 40%,同时结合 Grafana 可视化,故障定位时间从小时级压缩至分钟级。
•参与公司内部运维自动化平台的架构设计与模块开发,负责多云资源管理与任务编排模块。
•使用 Go 编写资源调度引擎,统一纳管 200+ 云主机,自动执行夜间批量任务,任务执行成功率提升至 99.9%。
•引入 Rundeck 作为作业调度中心,与 CMDB 联动实现资产自动发现,减少人工录入错误,运维团队日常操作负担降低 50%。
•主导构建了基于状态机的智能故障自愈系统,覆盖服务降级、数据修复、流量切换等 20+ 种故障场景。
•编写 Python 策略引擎,对接 Prometheus 告警,自动调用 Ansible Playbook 或容器编排 API 执行恢复动作,实现 7×24 小时无人值守自愈。
•在支付与订单服务试点后,故障平均恢复时间(MTTR)从 45 分钟骤降至 5 分钟,业务中断损失减少 90%,方案被推广至全部核心线。
对自动化运维充满热情,享受用代码将重复操作转化为可靠流程,追求系统稳定与响应效率;具备严谨的工程思维,习惯从监控数据中预判风险,而非被动救火。擅长用脚本语言构建自动化工具,熟悉容器编排与持续交付链路的落地,能快速识别瓶颈并给出优化方案。团队协作中乐于分享技术方案,持续关注云原生演进,希望深耕自动化运维,用技术保障业务连续性。
CI/CD流水线(Jenkins、GitLab CI)
运维效率工具集:
基于 Python 与 Shell 开发多服务器日志自动化分析工具,定期抓取应用日志,提取错误率、延迟等关键指标并生成可视化日报,异常时自动推送告警,显著缩短了故障定位时间。