AMAZING RESUME
188****0116niu****@***.com北京35男服务器运维主管在职北京25k-35k •依托操作系统、数据库原理、网络协议等课程,深入探究Linux内核调度与存储机制,课设中实现简易MySQL连接池与慢查询可视化工具,夯实底层认知。
•带队参加全国大学生服务外包创新创业大赛,开发基于Prometheus+Grafana的混合云资源监控看板,获华东赛区二等奖,全程负责后端告警规则与运维部署,锤炼工程化落地能力。
华为技术有限公司 - 数据通信与基础架构部ICT巨头全球化技术平台
2014.07-2019.12
•全面负责企业数据中心数千台物理服务器及虚拟化集群的运维治理,涵盖硬件上架、系统装机、性能调优与全生命周期管理。
•带领8人运维小组,构建ITIL融合的运维标准与变更管理流程,将系统可用性提升至99.95%,全年P1级事故数量下降60%。
•作为业务与基础设施的桥梁,深度参与新零售、金融支付等业务线评审,提供容量规划与高可用架构建议,支撑了30余个核心业务平稳上线。
•定期输出资源利用率分析报告,推动闲置资源回收与弹性伸缩策略落地,两年内将硬件采购成本降低约25%。
京东科技集团 - 云平台与智能运维部产业互联网先行者技术驱动型
2020.01-2022.06
高级服务器运维工程师混合云运维运维开发灾备与安全
北京
•独立负责混合云环境中关键业务条线的运维保障,确保广告投放平台、实时计算等系统7×24小时持续服务。
•主导开发基于SaltStack的自助化运维平台,集成工单、巡检、自愈等功能,将日常操作效率提升约50%,人工介入频次下降40%。
•牵头制定服务器安全基线规范,定期组织红蓝对抗演练,连续两年零重大安全事件,成功防御数次大规模DDoS与挖矿攻击。
•深度参与两地三中心灾备体系建设,梳理业务RPO/RTO指标,编写并定期演练灾备切换手册,确保业务在极端场景下可于15分钟内恢复。
•担任项目负责人,统筹将传统物理机与虚拟机上运行的电商中台、供应链等业务迁移至容器化平台。
•制定分批次、可回滚的迁移方案,覆盖数据一致性校验、灰度引流、流量切换等关键环节。
•带领团队在4个月内完成涉及600+台服务器的平稳迁移,整体业务中断时长控制在20分钟以内。
•迁移后资源利用率提升25%,业务弹性扩容能力显著增强,服务器硬件故障导致的业务中断减少70%。
•作为核心成员参与公司公有云、私有云及边缘节点资源的一体化运维优化项目。
•梳理多云环境中因资源碎片化带来的监控盲区与成本浪费,提出统一资源标识与分层调度方案。
•落地资源动态分配与自动伸缩策略,实现高峰时段资源借用与低峰时段自动回收,整体资源利用率提升约35%。
•搭建统一的告警与视图平台,融合多云主机监控数据,实现从入口到底层的全链路追踪与快速定位。
对服务器架构的稳定与高效运行有近乎偏执的追求,将每一次故障复盘视为系统进化的养料;信奉“自动化即美德”,习惯用脚本替代重复操作,用监控提前预警风险。具备扎实的运维与数据库管理功底,能高效协调团队完成复杂变更,沟通中重逻辑、重流程;持续关注云原生与可观测性技术,希望在一个重视工程素养的团队中,长期深耕运维体系化建设。
技术博客与工具分享:
在个人博客持续输出运维实战系列,涵盖Zabbix深度定制、Ansible编排技巧、Kubernetes故障排查等主题,累计阅读量逾15万,并受邀为InfoQ运维专栏供稿。