
AMAZING RESUME · OPEN HORIZON
牛敬业
ETL数据开发工程师
188****5440niu****@***.com北京30男ETL数据开发工程师在职北京20k-30k •主导完成《数据库系统概论》课程设计,设计并实现分布式日志存储系统,采用分区表与索引优化策略将查询效率提升40%
•组织校园开源数据竞赛,负责搭建Kafka+Flink流处理环境,指导团队完成实时舆情分析系统开发,项目获校级创新实践奖
ETL数据开发工程师数据管道优化ETL性能调优数据接口设计
北京
•• 在电商核心交易系统ETL开发中,重构用户行为数据管道,采用Apache NiFi实现流数据自动化,将批处理耗时降低35%,支持日均2000万条数据处理。
•• 与产品经理协作,设计跨部门数据共享接口,运用RESTful API满足财务、营销团队个性化数据需求。
•• 参与星型模型数据仓库构建,优化事实表与维度表关联,确保历史数据回溯准确性达99.9%。
•• 建立ETL作业监控体系,通过Prometheus告警机制,将数据异常响应时间缩短至10分钟内。
资深ETL数据开发工程师大数据平台架构数据治理实时数据处理
北京
•• 领导团队搭建PB级大数据ETL架构,基于Kafka和Flink实现实时数据流处理,支撑公司核心业务分析。
•• 主导数据质量管控项目,设计规则引擎进行自动校验,使脏数据率下降60%。
•• 优化数据调度系统,迁移至DolphinScheduler,任务失败率从5%降至0.5%,提升整体稳定性。
•• 推动数据中台建设,封装通用数据服务API,为AI团队提供高质量训练数据。
•• 项目背景:物流客户需实时监控全球库存状态,现有系统延迟高、数据分散。
•• 项目职责:设计实时ETL架构,使用Kafka接收IoT设备数据,通过Spark Streaming处理并推送到前端。
•• 项目成果:实现库存数据分钟级更新,辅助客户降低15%库存成本。
•• 项目背景:银行进行数据湖迁移,需整合交易系统、CRM等多源数据。
•• 项目职责:开发数据抽取脚本,处理时间序列数据转换,解决历史数据不一致问题。
•• 项目成果:成功整合10+业务系统数据,构建统一数据湖,支持风险模型训练。
我痴迷于数据工程的精密与高效,视数据为业务增长的燃料。具备极强的责任心和探索精神,对数据一致性有近乎苛刻的追求。熟练掌握Kettle、Talend等ETL工具及Python、Shell脚本,擅长复杂数据转换逻辑设计与性能调优。同时,热衷于数据治理,曾开发自动化质量监控工具,显著提升数据可靠性。期待在ETL开发岗位上持续精进,用代码赋能业务决策。
高可用数据架构:
熟练整合HDFS与Flink构建ETL管道,为电商平台设计双11期间日均50TB订单数据清洗链路,通过Checkpoint机制保障事务一致性
优化ClickHouse集群配置,将复杂关联查询响应时间从分钟级压缩至秒级,支撑业务部门实时决策分析需求