138****5678niu****@***.com北京35男数据仓库经理在职北京30k-50k •系统修读数据库系统原理与大规模数据处理课程,期末成绩位列专业前 10%,具备深厚的理论储备。
•主导校内社团数据库服务器运维,通过 SQL 调优与索引重构,将核心查询响应时间缩短 50%,保障业务连续性。
•热衷于钻研数据同步与自动化运维脚本,曾编写 Python 工具实现日志巡检自动化,提升了故障发现效率。
数据仓库经理数仓架构治理数据资产运营跨部门协同
北京
•- 统筹数据中台战略,重构核心数仓体系,带领团队完成从传统数仓向湖仓架构的平滑迁移。
•- 搭建业务与技术翻译机制,将模糊的业务诉求转化为标准化的指标体系与数据产品,确保数据资产可复用。
•- 治理历史技术债,通过重构分区策略与压缩算法,显著降低存储成本,同时提升复杂报表的渲染速度。
•- 推行数据资产分级制度,建立全链路血缘监控,实现数据问题分钟级定位与修复,保障数据可信度。
•- 主导实时计算引擎引入,优化批流一体架构,支撑业务从 T+1 向准实时决策转变。
高级数据仓库开发工程师离线链路重构指标体系落地性能调优
北京
•- 负责保险核心业务域建模,设计符合金融规范的多层级数据仓库模型,覆盖承保、理赔等关键环节。
•- 编写高效的数据清洗脚本,处理来自核心业务系统与外部三方接口的异构数据,确保入仓数据标准统一。
•- 针对海量数据倾斜问题进行专项优化,调整 Hive 执行计划与资源调度策略,保障核心任务按时产出。
•- 为风控模型提供特征工程数据支持,协助算法团队提取高价值变量,提升模型预测精度。
•- 建立任务调度监控体系,自动化处理失败重试与告警,确保 T+1 数据产出的稳定性与连续性。
•- 项目背景:随着业务线合并,旧有数仓无法支撑实时性需求,且存储成本激增,亟需技术架构迭代。
•- 项目目标:打造流批一体的统一数据底座,实现数据秒级可见,同时大幅降低基础设施运维成本。
•- 我的职责:主导技术选型(Flink + Hudi + Iceberg),设计分层架构与数据流转规范,协调跨组资源推进落地。
•- 项目成果:成功支撑双十一大促流量洪峰,实现核心指标秒级查询,整体存储成本降低 40%,获得集团技术表彰。
•- 项目背景:为提升风控精度与营销 ROI,需打通分散在各系统的客户数据,构建统一的客户画像。
•- 项目目标:建立覆盖全生命周期的客户 360 度视图,支持精准获客与反欺诈场景。
•- 我的职责:设计客户维度模型与标签体系,开发复杂关联清洗脚本,确保多源数据实体对齐准确。
•- 项目成果:上线后反欺诈模型准确率提升 15%,营销响应率提升 20%,成为公司数据资产的核心组成部分。
我是一名对数据秩序有天然执念的技术管理者。在数据仓库领域深耕多年,享受将杂乱无章的业务数据梳理为清晰逻辑架构的过程。性格沉稳严谨,习惯用代码逻辑去验证业务假设,对数据准确性有着近乎苛刻的要求。擅长在技术深度与业务广度间寻找平衡,乐于通过代码规范和架构设计引领团队成长。期望在数据仓库经理的岗位上,继续以工匠精神打磨数据底座,让数据真正成为业务增长的引擎。
数据质量管理:
负责数据血缘梳理与质量规则配置,搭建异常告警机制,及时阻断脏数据入库,确保下游报表口径统一与准确。