•选修“分布式数据库”和“高并发系统设计”课程,完成基于MongoDB Change Stream的实时数据同步实验,加深了对Oplog机制的理解。
•参加全国大学生数据库应用创新大赛,设计MongoDB多活架构方案,通过模拟故障切换验证了Raft一致性协议的行为。
•联合开源爱好者组织“NoSQL运维之夜”活动,分享MongoDB Atlas在跨区域灾备中的实践经验,聚焦自动故障转移与备份策略。
北京星耀数据科技有限公司 - 运维部互联网高新技术企业
2016.01-2020.12
MongoDB高可用运维工程师MongoDB集群运维多活高可用设计索引优化与诊断版本升级零中断
北京
•负责公司电商平台MongoDB集群的全生命周期运维,涵盖数百个节点的监控告警、容量规划与性能调优。通过重构慢查询并引入覆盖索引,使商品列表页的响应时间减少了40%。
•主导设计并落地了跨机房多活MongoDB高可用架构,采用副本集+分片混合方案,配合心跳检测与自动故障转移,将全年可用性提升至99.99%。
•牵头完成MongoDB大版本升级(3.6→4.4),制定灰度切换方案与回滚预案,利用滚动升级在夜间窗口完成,实现零停机、零数据丢失。
•面向内部研发团队开设MongoDB性能诊断培训,建立常见问题知识库,使工单平均处理时长缩短了50%。
北京智学在线科技有限公司 - 技术部软件研发创新型企业
2013.07-2015.12
MongoDB运维工程师MongoDB资源治理备份恢复与容灾演练监控告警体系建设运维标准化文档
北京
•管理公司在线教育业务线的MongoDB数据库资源,基于业务增长曲线实施弹性扩缩容,将硬件资源利用率提升约30%,降低了闲置成本。
•建立了全自动备份与恢复体系,配置每日增量备份与每周全量快照,并按季度进行容灾演练,确保任意时间点恢复在1小时内完成。
•部署了自定义监控大盘,对连接数、复制延迟、锁等待等指标设置分级告警,提前发现并处理了多次潜在慢查询风暴。
•编写了《MongoDB标准运维手册》和《紧急故障处理SOP》,成为团队新成员入职必读材料。
电商核心交易系统数据库项目 - MongoDB运维负责人
2018.05-2019.12
•该项目为电商平台的核心交易链路提供数据底座,承载订单、库存、用户画像等海量半结构化数据。
•作为MongoDB运维负责人,主导数据库架构设计,规划了基于哈希分片键的集群方案,支撑每日数亿级读写请求。
•针对高频查询场景,设计复合索引并优化查询计划,使订单查询接口的P99延迟从1.8秒降至450毫秒以内。
•在大促前完成集群的横向扩容与压测,通过预先分裂chunk和调整均衡窗口,保障了流量洪峰下的平稳运行。
在线教育新业务线数据库建设项目 - MongoDB运维工程师
2014.03-2014.12
•参与公司新业务线数据库选型与建设,采用MongoDB存储课程元数据、学习记录和互动日志。
•负责从零搭建数据库服务器环境,完成副本集配置、连通性测试和性能基线采集。
•与后端开发团队协作,共同设计数据模型,将嵌套文档与引用模式结合,减少跨表查询。
•实施数据库安全加固,包括启用SCRAM认证、配置网络白名单、对敏感字段进行客户端加密,确保数据安全。
Linux运维与自动化:
热衷在Rocky Linux环境中调优MongoDB,擅长使用`perf`、`strace`和`eBPF`工具分析慢查询与锁争用,并编写Ansible剧本实现集群滚动升级的无人值守。