AMAZING RESUME
牛敬业
数据仓库运维工程师
常怀探索之心,以实干沉淀自身价值
188****6175niu****@***.com北京30男数据仓库运维工程师在职北京18k-25k •在校期间,通过《分布式系统》、《数据库系统实现》等课程,深入理解数据分片与副本一致性原理,并基于LSM-Tree存储引擎设计了一个简化的键值数据存储。同时,作为核心成员参与“基于流计算的实时数据质量监控”校级创新项目,负责异常检测规则引擎的开发,项目获评优秀结题。
北京云擎数据科技有限公司 - 数据平台部企业级数据服务
2016.07-2019.12
数据仓库运维工程师数仓集群运维查询优化故障诊断ETL保障
北京
•- 负责企业级数据仓库的日常保障,覆盖集群巡检、资源水位监控、慢查询与异常作业的实时诊断,确保整体服务SLA达标。
•- 参与数仓架构的迭代演进,推动存储分层与计算资源弹性伸缩,使冷热数据分级管理,显著降低存储成本和计算延迟。
•- 与数据工程团队紧密协作,优化ETL调度链路,通过血缘追踪与数据校验规则,拦截脏数据并提升下游报表可信度。
•- 主导备份与容灾策略的制定,定期执行跨机房恢复演练,验证RPO和RTO,加固数据安全最后一道防线。
•- 输出标准化运维手册和故障预案库,面向新人和业务方开展数仓使用与排障培训,沉淀团队知识资产。
北京数联智造信息技术有限公司 - 大数据运维部智能制造数据服务
2020.01-至今
高级数据仓库运维工程师运维团队管理自动化运维体系建设湖仓一体平台保障
北京
•- 带领运维小组承接公司核心数仓的稳定运行,建立值班机制与效能看板,将平均故障恢复时间缩短40%。
•- 基于业务增长模型进行容量规划与资源预算,通过混合云部署和算力分时复用,在保障性能前提下降低年度运维成本。
•- 设计和落地自动化运维体系,集成Prometheus、Grafana与自研告警引擎,实现节点故障自动摘除和弹性扩容。
•- 深入业务线,与营销、供应链等团队对齐数据需求,从运维视角提出物化视图、数据预聚合等优化建议,加速报表产出。
•- 参与公司湖仓一体平台的建设,协同大数据团队推动流批一体的运维监控方案,保障实时数据链路的稳定。
数仓查询加速与资源优化专项 - 数据仓库运维工程师
2017.05-2017.10
•- 项目背景:电商大促期间,实时与离线报表并发激增,原有星型模型在复杂关联查询下出现严重延迟,影响运营决策。
•- 项目目标:在不大量增加硬件的前提下,大幅提升核心报表的响应速度,并建立资源管控机制。
•- 我的职责:主导性能瓶颈分析,通过重新设计分区键、构建聚合表、优化执行计划以及引入查询缓存,使Top20慢查询响应时间从平均23秒降至8秒以内。同时,实施资源组隔离,防止一次查询打满集群。
•- 项目成果:大促期间数仓承压能力提升3倍,报表准时产出率恢复至99.9%,获得业务线联名嘉奖。
集团统一数据底座运维体系构建 - 数据仓库运维工程师
2020.03-2020.08
•- 项目背景:企业为打破数据孤岛,启动全集团统一数据底座项目,需将ERP、CRM、IoT等异构数据源汇聚至新数仓平台。
•- 项目目标:搭建高可用、可扩展的运维框架,保障数据迁移与日常运行。
•- 我的职责:负责生产环境部署、权限体系与调度链配置;制定分批次数据迁移与校验方案,利用数据比对工具确保千万级记录无损同步;建立迁移期间的并行运行与回滚策略。
•- 项目成果:平台提前上线,平稳承接6个核心业务系统数据,为后续数据治理和自助分析打下坚实基础。
对数据系统的稳定和高效运行有天然的责任感,享受从告警中抽丝剥茧、定位根因的过程。具备严谨的工程思维与自动化意识,习惯用脚本替代重复劳动,对Linux、数据库以及Hive、Spark等工具栈有扎实的掌控力。沟通时注重理清需求边界,能与开发、业务方顺畅协作,共同守护数据时效与质量。希望持续在数据仓库运维领域深耕,用技术提升系统韧性。
运维工具链实践:
掌握Python与Shell在运维场景下的混合编程,曾独立实现一套数据库备份完整性校验工具,自动对比源端与备端表结构、行数及抽样哈希,并生成差异报告,已应用于3个核心业务库的日常巡检。