牛敬业
188****8990niu****@***.com北京35男系统运维主管在职北京25k-35k •核心课程项目:独立实现一个支持基本SQL语句的微型数据库,涵盖词法解析、查询优化与简单的故障恢复机制。
•校园运维实践:主导搭建了一套基于Nginx+Keepalived的高可用Web服务,并编写了自动化部署脚本,实现了故障自愈。
系统运维工程师高可用架构备份恢复中间件升级性能调优
北京
•负责支撑日活数百万用户的电商平台服务器集群运维,通过自研巡检脚本与智能告警联动,将全年非计划停机控制在30分钟以内,核心交易链路可用性达到99.99%。
•重构多地多活容灾预案,实现数据库与文件存储的分钟级增量备份与异地同步,关键业务RTO从小时级缩短至8分钟。
•主导完成200+台物理机操作系统及中间件升级,采用灰度发布与自动化回滚策略,实现零业务中断平滑切换。
•深入参与性能压测与调优,联合开发团队对慢SQL、缓存穿透等问题进行治理,双11大促期间系统平均响应时间下降25%。
智行天下网络技术有限公司 - 运维部智慧交通科技企业
2016.01-2019.12
系统运维经理团队建设运维中台ITIL流程成本优化
北京
•带领12人运维团队支撑智慧交通SaaS平台,制定季度OKR与预算方案,通过资源调度优化与老旧设备淘汰,年度基础设施成本降低18%。
•从零搭建运维自动化中台,整合CMDB、CI/CD流水线与统一监控,实现90%以上变更自助化,运维人效提升近50%。
•导入ITIL事件、问题、变更管理流程,配套工单系统与SLA指标看板,服务请求平均响应时间压缩至12分钟,业务部门满意度提升至96%。
•优化对外采购模式,引入多家IDC及CDN服务商竞争性谈判,并建立使用量实时核算体系,带宽与机柜采购成本下降22%。
领航未来信息技术有限公司 - 运维部企业服务科技企业
2020.01-至今
系统运维主管混合云架构容器化迁移应急响应组织发展
北京
•统筹公司多云环境下整体运维架构,制定三年技术演进路线图,推动运维从传统数据中心向混合云+边缘计算方向转型。
•主导核心业务系统向云原生架构迁移,将70%以上业务容器化并部署于混合云,弹性扩缩容响应速度提升至秒级,硬件总成本降低35%。
•建立跨部门全链路故障应急机制,组织常态化红蓝对抗演练,近两年成功处置多起大型网络攻击与磁盘阵列故障,保障业务零中断。
•搭建技术人才梯队,通过内部技术分享与轮岗机制,培养出4名高级工程师,团队整体方案设计能力与故障自愈能力显著提升。
•项目背景:公司业务从区域性扩展至全国,原有单机房架构存在单点风险,亟需进行高可用与异地多活改造。
•项目职责:作为项目负责人,带领团队完成业务流量分析、多活架构设计、数据同步方案选型及实施。
•项目成果:建成同城双活加异地灾备体系,系统容量提升3倍,核心交易峰值QPS承载能力翻倍,顺利支撑业务量级跨越。
智慧交通SaaS平台运维体系搭建项目 - 技术负责人
2017.09-2018.06
•项目背景:公司新推出面向城市公交集团的SaaS产品,需要从零构建可支撑多地客户部署的标准化运维体系。
•项目职责:主导设计运维架构,包括多租户隔离方案、混合云网络规划、自动化监控与日志平台搭建。
•项目成果:新平台上线后,租户交付效率提升60%,通过统一告警与自愈策略,故障平均发现时间降至5分钟,首批客户顺利上线。
对系统稳定与灾备韧性有近乎偏执的追求,习惯在监控曲线和日志细节里找隐患,享受用自动化把重复劳动变成优雅的编排。十余年技术路线上,始终把严谨、闭环与成本意识当作运维本能,擅长从架构规划到云迁移落地的全过程把控。带过团队,能拆解复杂问题、推动流程标准化,希望在一个重视可靠性与技术深度的环境中持续深耕。
云原生与自动化运维实践:
热衷Kubernetes生态系统,基于K3s在家搭建了多节点集群,并利用ArgoCD实现了GitOps自动化部署,用于托管个人博客和监控面板。
长期关注可观测性技术,集成Prometheus、Loki和Grafana构建了日志与指标监控栈,并编写了自定义告警规则,实现了异常事件的钉钉通知。