•作为校园网络技术社核心成员,参与设计并部署了针对校内 Web 服务的智能 DNS 解析实验,结合开源 PowerDNS 实现了基于用户 IP 地理位置的就近接入,将平均首包时延降低约 30%。
•加入校龙舟队,在长期配合训练中锤炼出高压力下的冷静决策与团队默契,连续两年获评“优秀学生干部”,并作为执行主席统筹了 3 场校级黑客马拉松,吸引超过 200 名开发者参与 CDN 加速优化专题挑战。
DBA(CDN方向)高可用架构CDN数据库查询优化监控体系建设
北京
•- 负责在线视频分发平台CDN业务集群的数据库全生命周期管理,涵盖MySQL集群的部署、参数调优、主从拓扑维护及自动化监控,将核心库的可用性提升至99.99%。
•- 主导CDN调度系统数据库的架构演进,针对日志数据爆发式增长的问题,引入分库分表与冷热数据分离策略,并设计复合索引方案,使数据检索延迟降低45%。
•- 建立故障快速响应机制,通过定制化Prometheus告警规则和慢查询自动采集,将平均故障发现时间从15分钟压缩到3分钟以内,并主导编写故障复盘手册。
•- 与边缘计算团队深度协作,为边缘节点数据同步组件提供SQL优化建议,重构了缓存刷新模块的存储过程,消除了大促期间因数据库锁等待引发的业务抖动。
某移动互联网公司 - 数据平台部用户增长期技术氛围浓厚
2012.07-2015.12
数据库工程师备份恢复技术培训成本优化数据库迁移
北京
•- 参与社交应用后台数据库的选型与搭建,根据UGC内容爆发特性,制定了MySQL多实例部署方案和全量增量结合的备份恢复策略,并每季度组织一次异地容灾恢复演练。
•- 守护数据库日常运行,通过InnoDB引擎参数调优和定期碎片整理,将核心表空间膨胀速度降低30%,并主动修复了多个未被应用侧感知的潜在主键冲突隐患。
•- 担任部门内部数据库技术小教员,面向后端开发新人开设《SQL写法与索引设计》系列工坊,累计培训超过50人次,显著降低了代码评审中发现的低效SQL占比。
•- 调研并引入Oracle到MySQL的迁移工具链,成功将一套遗留报表系统平滑迁移,在保证数据一致性的前提下,节省了每年约30%的数据库许可成本。
CDN调度中心数据库分片改造项目 - 数据库架构师
2018.05-2019.03
•- 项目背景是视频点播流量翻倍导致调度系统数据库写入瓶颈,需彻底重构存储架构。
•- 我负责设计基于用户ID哈希的分布式数据库方案,将单库拆分为8个逻辑分片,并使用ProxySQL实现透明的读写分离,支撑了每秒10万+的记录写入。
•- 对调度核心SQL进行深度优化,将原本依赖全表扫描的域名匹配逻辑改为前缀索引加程序缓存,使P99查询耗时从800ms降至50ms。
•- 制定了分阶段数据重分布方案,利用夜间低峰窗口,通过binlog回放与增量校验,在零业务中断的前提下完成了全量数据的平滑迁移,系统整体吞吐量提升至原来的3倍。
边缘节点轻量数据库标准化部署项目 - 数据库工程师
2013.09-2014.06
•- 承担全国20个边缘计算节点的数据库标准化落地,负责在ARM架构服务器上适配MySQL 8.0,并完成编译、安装与基础性能基线测试。
•- 针对边缘节点带宽受限、存储空间小的特点,关闭不必要的查询缓存和性能模式,调整binlog格式为ROW并压缩,将单节点数据库内存占用控制在500MB以内。
•- 搭建了基于Prometheus + Grafana的边缘数据库监控面板,通过编写自定义脚本定时采集节点延迟、磁盘IO及复制状态,一旦出现延迟超过阈值即自动触发邮件告警。
•- 项目交付后,边缘节点内容命中率关联的数据库查询时间平均缩短了60%,有效提升了终端用户的视频首屏打开速度。
CDN 节点容灾与故障自愈演练:
深入实践 CDN 边缘节点的健康检测与故障转移机制,基于 Nginx + Keepalived 搭建了双活高可用调度层,并编写自动化脚本实现节点异常时的秒级流量切换,保障核心业务可用性不低于 99.9%。
主导设计过一套面向 CDN 日志的异常检测 pipeline,通过 Flume 采集边缘节点日志,结合 Kafka 与自研规则引擎,能够在 5 分钟内定位回源超时、缓存穿透等故障,并自动触发降级策略。
定期组织跨地域的 CDN 容灾演练,模拟骨干网中断、源站宕机等极端场景,输出《CDN 应急响应手册》,将故障平均恢复时间(MTTR)从 15 分钟压缩至 5 分钟以内。