
AMAZING RESUME · MORNING LIGHT
牛敬业
数据仓库数据治理专员
188****8750niu****@***.com北京30男数据仓库数据治理专员在职北京15k-25k •在数据库课程设计中,基于MySQL构建零售销售数据仓库,完成ER模型到星型模型的转换,实现拉链表与分区表设计,并编写存储过程进行增量ETL,清洗脏数据3万余条。
•参与校级数据治理训练营,针对教务系统数据质量问题进行根因分析,设计数据质量监控规则,利用Python脚本实现空值、重复值与异常值自动检测,推动数据完整率提升至99%。
•作为核心成员参加“泰迪杯”数据挖掘竞赛,负责数据预处理与特征工程,对千万级行为日志进行清洗、脱敏与聚合,最终团队获全国三等奖。
北京智联云科技股份有限公司 - 数据中心高新技术企业互联网行业
2017.07-2020.06
数据仓库数据治理专员数据质量监控数据资产梳理数仓治理
北京
•负责公司零售业务数据仓库的数据质量监控,建立了针对销售、库存、会员等核心主题的自动化稽核规则,异常数据发现率提升至99%,显著降低了报表纠纷。
•牵头梳理企业级数据字典,统一了3000+数据字段的业务定义与技术命名,消除同名异义、同义异名现象,并输出了数据标准管理手册。
•重构ETL调度流程,将原有串行批次改为增量加载与并行处理,并引入任务依赖自检机制,使得每日数据就绪时间提前2小时,保障了运营报表的及时性。
•协同市场、运营、供应链等部门,推动数据资产门户建设,运用目录分级与标签体系纳管了8大业务域,形成可视化数据地图,方便业务人员自助取数。
北京恒通金融信息服务有限公司 - 数据治理部金融科技创新企业
2020.07-2022.08
数据仓库数据治理专员血缘分析安全合规生命周期管理
北京
•构建了跨系统数据血缘解析引擎,通过解析ETL脚本与日志,自动捕获从源系统到下游报表的完整链路,覆盖信贷、风控、反欺诈等10个核心系统,支撑快速影响分析与变更评估。
•策划并组织了6期数据治理工作坊,结合实际业务场景讲解数据标准、质量规范,以案例驱动提升业务部门数据Owner意识,参训人员超过80人,形成了数据治理知识库。
•制定数据生命周期管理策略,对历史数据按冷温热进行分层,并实施定期归档与清理,累计释放存储资源40TB,同时优化了查询性能。
•参与数据分类分级专项,编制敏感数据识别规则,推动动态脱敏策略在测试与开发环境落地,确保2000+敏感字段在共享使用中的安全合规,无数据泄露事件。
•作为核心成员参与公司自研数据质量智能监控平台的建设。负责数据质量模块的设计与开发,搭建可配置的规则引擎,支持自定义校验函数、动态阈值及告警策略,并集成数据跑批监控大屏。
•平台上线后,数据质量问题发现时间从人工跑脚本的T+1天缩短至分钟级,并自动生成分域质量报告,推动问题闭环效率提升50%,有效降低了数据事故。
•主导集团级主数据标准统一工程。深入调研各业务线需求,梳理并制定客户、供应商、产品、组织四大核心域的主数据标准,对齐了实体的唯一标识与核心属性。
•推动客户主数据统一,通过模糊匹配算法与人工复核相结合,合并了大量重复记录,使客户唯一性标识的覆盖率从85%提升至98%,并建立了标准变更的线上审批流程,确保后续新增数据的一致性与可用性。
对数据秩序有天然的敏感与执着,相信每一份干净、可溯源的数据都是业务决策的底气。长期保持对数据规范与血缘的敬畏,习惯用严谨的逻辑拆解治理难题。能熟练运用脚本与工具将繁琐的校验自动化,也乐于在跨团队协作中搭建共识、推动标准落地。希望在一个重视数据文化的环境里,持续打磨治理能力,成为让数据资产真正可信的守护者。
数据仓库架构设计:
熟练运用Kimball维度建模与Data Vault建模思想,曾主导构建企业级数据仓库分层体系(ODS/DWD/DWS/ADS),明确各层数据粒度和退化维度策略,兼顾查询性能与存储成本。
在电商数据仓库项目中,设计拉链表及各粒度快照表,实现历史状态追溯与增量合并,同时优化分区键和索引,将核心报表查询耗时从15秒压缩至2秒以内。