CV

AMAZING RESUME
牛敬业
数据仓库迁移工程师
188****9370niu****@***.com北京30男数据仓库迁移工程师在职北京20k-30k •通过操作系统、分布式计算与大数据存储等课程,深入理解数据分片、副本一致性与故障恢复机制,为数据迁移中的高可用设计打下基础。
•参与校内数据治理创新项目,主导设计跨业务系统的历史数据归档与迁移方案,利用Shell脚本与Python实现自动化校验,确保千万级记录零丢失。
•在国家级数据挖掘竞赛中针对电商异构数据源集成问题,设计全量+增量同步策略,并构建异常检测看板,获得省级二等奖,磨炼了数据全链路处理与工程落地能力。
北京数驱科技有限公司 - 数据平台部专精特新大数据服务商
2018.01-2022.06
•主导公司数据仓库从本地化部署向混合云架构的整体迁移,独立完成技术选型、容量规划与风险评估,输出分阶段迁移路线图。
•拉通基础设施、数据开发与业务分析三个团队,通过双跑验证、分层回切等机制保障迁移期间业务零中断、数据零丢失。
•负责一个日均处理量超PB级的数据仓库改造项目,重新设计数据分层与生命周期管理策略,迁移后计算资源利用率提升约45%。
•重构离线ETL流程,引入流批一体处理框架与自动化调度工具,将数据新鲜度从T+1缩短至小时级,处理效率提升35%以上。
•沉淀方法论,编写《数据仓库迁移白皮书》与故障排查手册,组织内部技术沙龙,带动团队整体迁移交付能力提升。
北京融信数字科技有限公司 - 数据智能中心金融科技高成长企业
2016.07-2017.12
•参与企业级数据仓库的日常运维与治理,建立监控告警体系,保障核心链路可用性维持在99.95%以上。
•基于维度建模方法论,为供应链、风控等业务域设计数据模型,优化存储结构与查询路径,使高频报表响应速度提升近3倍。
•负责数据中台与财务、客户关系管理等外部系统的数据对接,设计统一数据接入规范,确保多源异构数据的一致性。
•对接业务方数据需求,搭建自助分析看板,为运营决策提供多维度的数据支持,累计交付报表超200个。
•主导慢SQL专项治理,通过执行计划分析、索引重构与分区裁剪等手段,大幅改善核心作业的并发处理能力。
某头部零售企业数据仓库全量迁移项目 - 技术负责人
2019.05-2020.03
•该项目为某大型线下零售连锁企业,需要将其基于传统一体机的数据仓库完整迁移至云原生数据湖仓体系。
•前期开展了为期三周的业务调研与数据资产盘点,梳理出300余个数据模型与近千条ETL任务,制定分级迁移策略。
•主导ETL流程的重新编排,采用CDC实时同步与批量离线并行方案,确保全量数据与增量数据的最终一致性。
•联合测试、运维与业务方进行多轮压力测试与数据比对,攻克了字符集不一致、时区转换等遗留问题。
•上线后,新平台支持弹性伸缩,整体计算成本降低30%,同时支撑了业务部门更灵活的实时营销分析需求。
某保险集团数据仓库性能优化与搬迁项目 - 核心成员
2017.01-2017.06
•参与某大型保险集团的数据仓库深度优化与机房搬迁工程。
•对现有系统进行全面的性能基线测试,定位出资源争用严重、数据倾斜等关键瓶颈。
•设计并落地优化方案,包括重新设计部分核心表的数据分布键、实施物化视图与结果集缓存策略。
•同步将数据仓库服务平滑迁移至新的高性能集群,通过蓝绿部署确保切换过程对上游报表无感知。
•交付后,精算、核保等核心场景的查询延迟从分钟级降至秒级,系统整体可用性达到99.99%。
对数据流动与系统迁移抱有持续热情,习惯从底层原理出发理解不同架构的差异,享受在复杂链路中寻找最优解。做事沉稳细致,追求迁移过程的高可靠与低风险,善于在压力下拆解难题并规划路径。具备扎实的脚本化与自动化能力,能顺畅串联各方资源推动落地。对数据生态演进保持好奇,乐于将新工具沉淀为生产力,持续提升交付质量。
数据架构与分层建模:
善于从数据迁移与集成场景中抽象业务域,结合Kimball维度建模思想,灵活设计贴源层、明细层、汇总层,并通过血缘分析梳理上下游依赖,保障模型在重构过程中的平滑演进与查询性能。