188****2685niu****@***.com北京32男高级软件运维工程师在职北京25k-35k 
•加入学院高性能计算集群项目组,负责 MySQL 数据库集群的容量规划与慢查询优化,支撑日均百万级请求稳定运行
•创立校内 DevOps 兴趣小组,牵头搭建基于 GitLab CI 的自动化流水线,将代码部署效率提升 60% 并推广至 5 个实验室
•旁听《云原生架构》《容器技术》高阶课程,在开源社区贡献 Prometheus 监控插件代码,累计解决 20+ Issue
•负责核心交易系统的日常维护,通过实施滚动升级策略实现全年零停机发布,系统可用率提升至99.95%
•主导建立故障演练机制,将平均故障响应时间压缩至18分钟,关键业务恢复时间缩短60%
•优化分布式存储集群I/O调度算法,使大数据处理任务执行效率提升42%,存储成本降低28%
•设计并推行标准化SOP流程,构建运维知识库体系,新员工上岗培训周期缩短50%
•管理混合云环境下1200+计算节点,设计多云调度策略实现资源利用率提升35%
•开发基于IaC理念的自动化部署流水线,将环境搭建时间从8小时压缩至20分钟
•建立性能基线模型,通过压测数据反哺开发优化,核心接口QPS承载量提升2.3倍
•部署全链路追踪系统,构建多维度监控看板,预警准确率达97%,故障预防率提升80%
•重构核心账务系统部署架构,引入双活数据中心设计,实现跨地域容灾切换时间≤3分钟
•设计数据库分片策略与读写分离方案,支撑日均千万级交易并发,查询延迟降低58%
•构建全量数据备份验证机制,通过定期灾备演练确保RPO<1小时,RTO<15分钟
物联网平台弹性伸缩体系建设 - 高级软件运维工程师
2022.01-2022.06
•搭建Kubernetes集群并定制调度器,实现设备接入量突发增长时的自动扩缩容,资源利用率提升40%
•设计边缘计算节点管理方案,通过Terraform实现600+边缘站点的统一生命周期管理
•开发设备状态可视化大屏,整合日志分析与预测性维护算法,设备故障提前预警率达85%
热衷于探索系统运行的底层逻辑,享受通过技术手段让服务更稳定、更高效的过程。性格严谨细致,对线上异常保持高度敏感,能在压力下快速定位问题根源。深耕Linux系统管理与自动化运维实践,熟悉网络协议及数据库调优,掌握Ansible、Jenkins等工具链。持续跟进云原生与可观测性技术发展,愿在运维岗位上持续精进,打造更健壮的系统基座。
自动化运维实践:
熟练运用 Python 编写运维机器人,集成服务器巡检、日志分析等功能,接入企业微信实现 7x24 小时告警响应
深度实践 SaltStack 配置管理工具,标准化服务器初始化流程,实现 300+ 台节点的环境一致性交付与变更审计