•在校期间深入钻研操作系统内核与分布式系统理论,多次在课程设计中担任架构负责人。
•加入学院网络实验室,负责维护校园网核心服务器集群,参与过多次网络攻防演练活动。
•积极参加全国大学生运维技能大赛,通过自动化脚本解决复杂环境搭建任务,获省级优秀奖。
•负责核心业务系统底层 OS 的日常巡检与补丁管理,建立标准化巡检脚本,将人工巡检时间缩短 60%。
•推行基础设施代码化(IaC)理念,使用 Terraform 管理云资源生命周期,有效避免手动配置漂移。
•设计并落地数据库定期备份与灾备演练机制,多次模拟极端故障场景,验证 RTO/RPO 指标达标。
•协助研发团队定位线上疑难杂症,通过全链路追踪工具快速定位瓶颈,保障业务连续性。
•主导容器化平台落地,基于 Kubernetes 重构传统部署流程,实现应用弹性伸缩与滚动更新。
•设计多活容灾架构,协调不同可用区资源,确保单点故障下业务无感知切换。
•搭建统一监控大盘,整合系统指标与业务日志,通过异常检测算法提前预警潜在风险。
•负责云资源成本治理,通过预留实例与弹性策略优化,年度云支出降低约 25%。
•该项目旨在将传统物理机房数据库集群平滑迁移至云原生数据库服务,消除单点依赖。
•制定分阶段迁移计划,采用双写与数据校验方案,确保迁移期间数据零丢失、业务无中断。
•协调数据库团队与业务方,在业务低峰期完成割接,实际停机时间控制在 15 分钟以内。
•迁移后针对新架构进行压力测试与参数调优,使数据库读写并发能力较原架构提升 50%。
•参与公司新业务微服务架构的云底座搭建,提供高可用的计算与网络资源支撑。
•负责服务网格(Service Mesh)的基础设施配置,实现服务间的流量治理与熔断降级。
•与开发团队共同制定 CI/CD 流水线规范,确保代码从提交到生产部署的全自动化流转。
•上线后建立 7x24 小时值班响应机制,快速处理各类告警,保障新业务线平稳度过磨合期。
云资源成本治理:
擅长云资源成本分析与优化,曾通过标签化管理与弹性伸缩策略,有效识别闲置资源。通过实施成本预警机制,帮助部门在业务增长的同时将云支出控制在预算范围内,提升了资源投入产出比。