188****5445niu****@***.com北京30男运维工程师(IDC方向)在职北京18k-25k 
•独立完成《计算机组成原理》课程大作业,设计并仿真了五级流水线 CPU 模型,加深了对硬件执行流程和中断处理的理解。
•担任学院数据中心学生运维助理,负责 30 余台 Linux 服务器的日常监控与故障响应,并整理出标准化排障操作手册,保障了实验环境 99% 以上的可用性。
运维工程师(IDC方向)IDC运维硬件巡检网络调优服务器部署
北京
•负责北京数据中心机房内服务器、交换机、供配电等基础设施的日常巡检与状态监控,建立设备健康档案,对隐患提前预警。
•主导服务器操作系统的季度安全加固与补丁管理,制定灰度升级方案,确保业务零中断。
•针对机房南北向流量突发拥塞问题,重新规划核心交换机的负载均衡策略,将跨网段延迟降低 25%。
•配合业务团队完成电商大促期间的上线扩容,累计部署物理服务器 400 余台,并编写了标准化装机脚本。
资深运维工程师(IDC方向)基础设施运维容量规划自动化监控团队管理
北京
•统筹管理三个核心 IDC 机房的日常运维,带领 5 人团队梳理并落地了《IDC 运维标准操作手册》,提升故障处理一致性。
•通过分析历史资源使用趋势,引入虚拟化集群的弹性伸缩策略,将整体服务器资源利用率从 55% 提升至 80%。
•在机房扩建项目中担任技术负责人,从冷通道封闭设计、设备选型到上架布线全程把控,新增 80 个标准机柜并按时交付。
•搭建了基于 Prometheus + Grafana 的实时监控告警体系,联动自研的故障自愈脚本,将平均故障响应时间压缩至 12 分钟。
•负责在线业务服务器的全量数据备份与一致性校验,设计回滚方案,确保核心交易系统迁移过程数据零丢失。
•协调网络、系统及业务方制定分批次迁移时间窗口,在 3 个月内平稳完成 150 台物理服务器的跨机房搬迁。
•迁移后对数据库和中间件性能进行调优,重新配置连接池参数,使核心接口响应速度提升 18%。
•主导机房能效优化项目,引入冷热通道隔离与智能温控系统,动态调节精密空调输出,使机房 PUE 值从 1.6 降至 1.4。
•部署了基于物联网的能耗采集平台,对机柜级电力进行实时监测,识别出 12% 的僵尸服务器并推动回收。
•项目落地后,机房年耗电量减少约 120 万度,获公司年度技术创新奖。
对基础设施的稳定运行有某种执念,享受在机柜与命令行间排查故障、打磨细节的过程。习惯于从能耗、散热到线缆管理都保持严谨,擅长在压力下冷静诊断并推动问题闭环。持有服务器与网络设备运维的系统化思路,并对节能改造有实战沉淀,希望在一个重视可靠性的团队里持续深耕 IDC 运维。
运维自动化工具开发:
使用 Python 与 SaltStack 编写了跨机房服务器状态采集与告警系统,实现了对磁盘、内存、进程的实时监控,异常响应时间缩短至 5 分钟内。