•代表学校出征全国大学生数学建模竞赛,负责海量气象数据的清洗与索引策略设计,在三天内将千万级数据的查询耗时从 8 秒压缩至 1.2 秒,初步掌握了利用索引与查询重写解决性能瓶颈的思路。
•大三加入学校高性能计算中心,参与维护一个基于 PostgreSQL 的科研仪器日志库,主导了分区表改造与 WAL 优化,使 10 亿行数据表的范围扫描速度提升 4 倍,并由此系统建立了对数据库内核参数调优的理解。
•在《数据库系统实现》课程中,独立实现了一个基于 LSM-tree 的迷你存储引擎,包括 MemTable、SSTable 压缩与布隆过滤器,深入理解了写入放大与读放大的平衡,为后续诊断慢查询和存储层问题提供了底层视角。
数据库性能优化运维工程师数据库运维性能调优SQL 优化
北京
•负责公司核心支付与交易数据库的日常运维,涵盖 MySQL 集群的安装、配置、备份恢复与高可用切换。通过调整 InnoDB 缓冲池大小、连接池参数及 Binlog 格式,将核心交易链路平均响应时间压缩了 35%,支撑了日均 2000 万笔订单的平稳处理。
•基于慢查询日志和 pt-query-digest 工具,定期对数据库进行性能画像,针对全表扫描、隐式类型转换等高频问题,通过索引重构、查询逻辑改写及分区表设计,累计优化了超过 600 条慢查询,关键业务查询速度提升 2.5 倍以上。
•与研发团队建立数据库设计评审机制,在需求阶段即介入评估表结构与访问模式;在版本发布前,通过 Sysbench 自定义压测脚本模拟“双十一”流量洪峰,提前发现并修复了 4 个因锁竞争引发的潜在性能瓶颈。
高级数据库性能优化运维工程师分布式数据库性能监控技术培训
北京
•主导公司分布式数据库 TiDB 集群的性能优化与容量规划。深入分析 Region 分裂与调度策略,结合业务读写特征重新划分片键并调整副本数,使集群整体吞吐量提升 45%,成功扛住疫情后线上流量 3 倍的增长。
•搭建基于 Zabbix + ELK 的数据库全链路性能监控体系,定制了 200 余项监控指标与动态阈值告警,实现了从 SQL 执行耗时到磁盘 I/O 延迟的端到端可视。通过监控数据提前预警了 3 次硬件故障,避免了业务中断。
•策划并组织 8 期“数据库性能特训营”,为 SRE 及后端开发工程师讲授索引原理、执行计划解读与慢查询治理方法,累计培养 7 名可独立承担数据库运维的骨干,并沉淀了《数据库操作规范》与《应急响应手册》。
在线教育平台数据库性能优化项目 - 数据库性能优化负责人
2018.05-2018.12
•主导公司某头部在线教育平台数据库性能优化项目。该平台直播课并发峰值超过 50 万,数据库频繁出现 CPU 飙升。通过对核心业务库实施读写分离与缓存层重构,将热点课程数据缓存在 Redis 中,使主库负载下降 55%,高峰时段服务可用性提升至 99.99%。
•针对学生课程表查询慢、经常超时的问题,深入分析执行计划,发现因多表 JOIN 未走索引导致全表扫描。通过创建覆盖索引和调整 JOIN 顺序,将查询耗时从平均 800ms 降至 150ms 以内,大幅改善了课堂互动体验。
•在项目中负责对接业务线需求,输出《数据库性能优化方案》,并协调开发、测试与运维团队完成改造、压测与灰度发布。项目上线后,数据库性能指标全面达标,为后续千万级用户增长扫清了性能障碍。
物流核心系统数据库升级与迁移项目 - 数据库升级项目经理
2019.03-2019.09
•主导公司物流履约核心系统数据库从 Oracle 11g 到 19c 的跨版本升级。原系统存在大量硬编码 SQL 和过期的统计信息,性能与安全风险较高。通过制定分阶段升级方案,利用 Oracle GoldenGate 实现数据实时同步,将停机窗口控制在 10 分钟以内。
•在升级过程中,针对 19c 的新特性如自适应执行计划、自动索引优化等,重新配置了 30 余个数据库参数,并对 200 余条关键 SQL 进行了改写与验证,使系统整体吞吐量提升 25%,高峰期订单处理延迟降低 30%。
•该项目涉及全国 300 多个分拨中心的数据同步,对数据一致性和业务连续性要求极为苛刻。通过多轮全链路模拟演练和严密的回滚方案,确保了项目一次上线成功,未发生任何数据丢失或服务中断事故。
数据库可观测性与自愈平台:
搭建了基于 Prometheus + Alertmanager 的数据库监控工具体系,为 MySQL 和 Redis 自定义 Exporter 采集每秒锁超时次数、脏页刷新速率等细粒度指标,并联动 Python 脚本实现了慢查询自动查杀与索引推荐,将异常发现到止血的平均时长从 15 分钟降至 3 分钟以内。