•担任校学生技术俱乐部核心成员,组织全国高校联合黑客马拉松,并带队开发“智能运维告警平台”,基于MySQL实现事件聚合与分级通知,获最佳实用奖。
•选修《分布式系统设计》并完成课程项目——基于Multi-Paxos的分布式配置中心,实现节点动态发现与数据一致性,通过Chaos Engineering验证容错。
•与团队参加“华为云数据库应用创新大赛”,设计高并发票务系统,利用MySQL分区表与Elasticsearch混合检索,负责全链路压测与数据库优化,获华中赛区一等奖。
•毕业设计课题为《基于机器学习的数据库参数自动调优》,使用贝叶斯优化自动调整InnoDB缓冲池与线程数,在TPC-C基准上实现吞吐量提升40%,获评院级优秀论文。
数据库运维工程师数据库高可用慢查询优化自动化运维
北京
•- 负责外卖与到店事业群核心数据库的日常运维,涵盖MySQL、Redis集群的部署、备份、恢复与容量规划,维护数千实例的稳定运行。
•- 搭建基于Prometheus+Grafana+自研采集器的监控体系,对慢查询、锁等待、复制延迟等指标进行实时告警,全年故障恢复时间控制在分钟级。
•- 深度参与数据库架构演进,推动读写分离、分库分表方案落地,并针对大促场景设计弹性扩容策略,保障峰值流量下的数据一致性。
•- 与后端开发团队共建代码审核规范,从SQL设计阶段介入,定期输出慢查询优化建议清单,将线上慢查询数量降低40%。
•- 每月进行全量数据库健康巡检,利用pt-query-digest分析性能趋势,输出容量与风险报告,为技术经理提供扩容决策依据。
高级数据库运维经理团队建设数据库架构治理资源成本优化
北京
•- 带领8人数据库运维团队,负责社交、广告、金融等多条业务线的数据库整体运维,涵盖MySQL、TiDB、ClickHouse等组件。
•- 制定并迭代数据库运维全生命周期规范,从接入、变更、巡检到下线,推动全部流程线上化,减少人为操作失误。
•- 主导数据库选型与架构评审,引入TiDB解决广告业务海量数据扩展难题,并评估云原生数据库产品,为技术中台建设提供决策输入。
•- 建立资源成本模型,通过合并闲置实例、冷热数据分层存储、容器化混合部署等手段,年度数据库成本降低约25%。
•- 与业务、研发、测试团队形成固定协作机制,每季度输出数据库优化蓝图,支撑了日活过亿产品的平稳迭代。
•- 搭建内部技术分享平台,定期组织故障复盘会与主题培训,培养出3名骨干成员晋升为高级工程师。
•- 该项目是将公司核心交易库从Oracle迁移至MySQL 8.0,并同步升级主从架构为MGR集群,以提升系统可扩展性。
•- 作为项目负责人,制定三阶段迁移计划,协调DBA、开发、测试资源,并负责风险预案与回滚演练。
•- 带领团队完成全量数据校验、存储过程改写、SQL兼容性测试,并搭建影子库进行压力测试,确保迁移后性能不低于原系统。
•- 迁移期间与业务方协同,采用灰度引流策略,分批切换流量,实现业务零感知。
•- 项目上线后,核心交易接口平均响应时间从200ms降至120ms,季度故障次数从4次降为1次,整体性能提升约40%。
•- 该项目是为公司增长业务构建一套实时数据仓库,用于支撑用户行为分析、实时报表等多维分析场景。
•- 参与需求评审与架构设计,确定采用ClickHouse作为核心存储引擎,并设计分层存储与冷热分离方案。
•- 带领团队完成集群部署、配置调优、数据接入管道搭建,以及实时物化视图的创建。
•- 针对高并发点查场景,优化索引策略与集群分片规则,将99分位查询延迟控制在2秒以内。
•- 制定备份策略与异地容灾方案,确保数据服务SLA达到99.95%。
•- 项目上线后,成功支撑日均百亿级数据写入,为运营决策提供了实时、稳定的数据底座。
灾备架构与数据恢复治理:
擅长构建融合物理备份、逻辑转储与实时复制的多重保障体系,针对不同业务场景设计异地灾备方案,确保关键数据零丢失。
主导常态化应急演练,包括数据库崩溃、存储故障等极端案例,形成标准化的故障响应手册,显著缩短业务中断时间,并持续优化恢复流程。
数据库全栈性能诊断与优化:
借助监控生态与自定义探针,深入追踪SQL执行计划、锁等待、缓存效率等细粒度指标,实现毫秒级异常检测。
能够串联应用逻辑、SQL执行与存储引擎,利用Profiling火焰图、操作系统追踪等手段,精准定位性能热点,并实施涵盖索引重构、查询改写、架构调整的组合优化。