CV

AMAZING RESUME
牛敬业
ETL数据采集开发运维
188****9832niu****@***.com北京30男ETL数据采集开发运维在职北京20k-30k •深入掌握数据结构、数据库原理、操作系统等课程,理解数据存储、索引优化与系统资源管理,支撑ETL任务的高效设计与故障排查。
•主导数据库课程设计项目,独立完成从需求分析、逻辑模型到物理实现的全流程,锻炼了SQL性能调优与数据清洗迁移的动手能力。
北京数联鹏程科技有限公司 - 数据开发部大数据技术
2015.07-2018.12
ETL开发工程师数据仓库开发数据集成ETL流程优化
北京
•• 负责公司数据中台ETL流程的设计与开发,使用DataStage工具完成从Hadoop HDFS、MongoDB、日志文件等异构数据源的抽取、清洗、转换与加载,单日处理数据量稳定在2TB以上。
•• 深入优化现有ETL作业,通过并行参数调整、增量抽取策略及SQL重写,将核心作业执行时间缩短40%,显著提升数据仓库的刷新时效。
•• 与财务、运营等业务部门紧密协作,梳理数据口径,设计贴合业务需求的维度模型,确保报表数据的准确性与一致性。
•• 编写标准化ETL开发文档,涵盖数据血缘、接口规范、异常处理流程等,为团队知识沉淀和后续维护提供全面支撑。
北京云帆数智技术服务有限公司 - 运维部信息技术服务
2019.01-2021.12
ETL运维工程师ETL系统运维运维自动化数据管道监控
北京
•• 负责公司全域ETL系统的日常运维,搭建自动化监控体系,通过脚本巡检实时捕捉作业失败、数据延迟等异常,系统可用性持续保持在99.95%。
•• 制定并实施ETL作业的备份与容灾恢复策略,定期组织数据恢复演练,确保在节点故障或数据误删时RTO小于30分钟。
•• 与数据开发团队协作,推动新ETL项目的灰度上线,完成环境搭建、依赖配置、压力测试,保障项目平滑过渡。
•• 解析ETL运行日志,利用Kibana构建可视化看板,提取作业时长、数据吞吐量等核心指标,输出每周运维报告,驱动系统架构优化。
企业级数据中台ETL采集体系构建项目 - ETL开发工程师
2016.05-2017.03
•• 项目背景:公司为整合线上交易、用户行为、供应链等十余个业务系统数据,计划构建统一数据中台,需设计一套高吞吐、低延迟的ETL采集体系。
•• 项目职责:作为核心开发成员,负责从Oracle、MySQL、Rest API等源端抽取数据,进行清洗(如空值填充、格式标准化)、转换(如日志解析、维度关联),并加载至Greenplum数据仓库。
•• 项目成果:ETL系统成功上线,每日处理数据量达800GB,数据加载成功率99.8%,为实时运营看板、用户画像等数据产品提供了坚实的数据底座。
实时数据采集管道性能调优项目 - ETL开发工程师
2020.05-2020.10
•• 项目背景:随着业务实时报表需求激增,原有批处理ETL管道数据传输延迟严重,无法满足秒级分析要求,亟需升级改造。
•• 项目职责:主导性能调优工作,通过火焰图分析系统瓶颈,将关键链路改用Spark Streaming实时处理,并优化Kafka分区策略与数据压缩算法。
•• 项目成果:优化后ETL作业端到端延迟降低55%,资源利用率提升30%,成功支撑了双十一大促期间毫秒级数据同步,获得公司技术突破奖。
对数据流转的准确性与系统稳定性有近乎偏执的追求,享受从异构数据源中梳理出干净、可靠的管道逻辑。习惯以严谨细致的态度对待每一次采集与清洗,对延迟和异常零容忍,能沉下心在日志与监控中复现并根治问题。在Informatica与SQL调优之外,我更看重对业务口径的透彻理解,把运维自动化与文档沉淀当作职业本能。期望在数据采集与运维领域持续深耕,用稳定可靠的工程交付支撑业务决策。
数据仓库建模:
精通维度建模方法论,包括星型与雪花模型,在多个数据仓库项目中独立设计事实表与维度表,并针对缓慢变化维度制定策略,确保ETL抽取时数据的一致性与查询性能。
能根据业务场景灵活选择模型,利用ERWin等工具完成物理模型设计,保障数据架构的易用性和可扩展性,支撑下游采集与分析的稳定运行。