AMAZING RESUME
牛敬业
数据采集监控运维开发工程师
188****4983niu****@***.com北京30男数据采集监控运维开发工程师在职北京15k - 25k •主修课程涵盖计算机组成原理、算法设计、数据库系统,并选修《流式计算与实时处理》《分布式存储技术》,重点掌握数据采集与处理链条的理论基础。
•加入学校云计算兴趣小组,参与搭建基于 Prometheus + Grafana 的教学机房监控平台,独立编写 Node Exporter 自定义采集脚本,实现 CPU、内存、磁盘 IO 等指标的可视化。
•带队参加全国大学生服务外包创新创业大赛,完成“分布式日志采集与异常检测系统”项目,设计 Filebeat + Kafka + Flink 采集链路,获东部赛区二等奖,提升了工程化落地能力。
•在课程实训中主导开发一套简易的运维数据采集工具,支持定时任务与 Webhook 告警,实践了 Linux 环境下的 Shell 脚本与 Python 开发,养成规范化文档与 Code Review 习惯。
北京某物联网科技公司 - 运维部高新技术企业行业领先
2016 - 07-2019 - 06
数据采集监控运维工程师物联网采集监控告警运维自动化
北京
•负责公司物联网数据采集平台的日常运维,保障全国2000+边缘节点7×24小时稳定运行。
•重构数据清洗与转发流水线,将端到端采集延迟降低40%,每月避免因传感器掉线造成的有效数据缺失约80GB。
•协同研发团队完成监控中台的功能迭代,新增趋势预测与多维告警聚合模块,使平均故障发现时间缩短至3分钟。
•编写《采集节点部署规范》与《常见故障处理手册》,并面向新员工开展三轮实操培训,团队独立处理告警的覆盖率提升至92%。
北京某产业互联网公司 - 研发运维部创新型企业技术驱动
2019 - 07-2022 - 06
高级数据采集监控运维开发工程师流批一体技术管理方案交付
北京
•主导公司新一代实时数据采集与监控平台的架构设计,采用Kafka+Flink的流批一体方案,支撑日均10亿条日志的采集与处理。
•带领5人小组完成平台灰度发布与全量上线,上线后核心链路可用性达到99.95%,P99延迟控制在200ms以内。
•作为技术接口人,对接三家制造企业客户,为其定制车间设备数据采集与异常诊断方案,客户年度续约率达到100%。
•推动团队引入GitOps与Helm Chart管理容器化部署,将新环境交付时间从3天压缩至4小时,资源利用率提升35%。
某电力企业数据采集监控平台项目 - 数据采集模块负责人
2017 - 03-2017 - 12
•该项目为某省级电力公司构建智能电表与SCADA系统的统一采集监控平台。
•负责采集模块开发,采用异步非阻塞网络模型,实现对20万终端并发连接的高效采集,每秒入库记录超15万条。
•设计并实现分级告警与自愈策略,当表码跳变或通信中断时,可在15秒内触发钉钉/短信通知并自动尝试重连,大幅降低漏抄率。
•参与整体性能调优,通过时序数据库选型与写入聚合,使查询响应时间从秒级降至毫秒级,满足调度部门对实时负荷监控的严苛要求。
某连锁零售数据采集监控系统升级项目 - 系统优化工程师
2020 - 05-2020 - 12
•参与某大型连锁零售企业门店POS与客流数据采集系统的升级改造。
•负责诊断旧系统瓶颈,提出数据分层存储方案,引入对象存储归档冷数据,使热数据查询性能提升3倍,存储成本下降40%。
•开发数据质量稽核模块,自动校验交易流水完整性与会员ID合法性,每月拦截异常数据约12万条,减少财务对账返工。
•与测试团队协同完成全链路压测,保障系统在双十一促销期间平稳支撑日均3000万笔交易采集,全程零故障。
我始终相信监控系统的价值在于防患于未然,而不是事后救火。多年运维开发经历让我养成了对数据流与告警链路极度敏感的习惯,擅长用Python/Shell构建自动化采集与诊断工具,对Zabbix等开源监控的二次开发有深入理解。享受排查复杂故障的挑战,也乐于将经验沉淀为可复用的脚本与文档,帮助团队降低响应时间。当前正深入钻研可观测性生态,期待在数据采集与监控方向持续深耕,用技术为业务稳定性护航。
容器化编排与部署:
精通 Docker 与 Kubernetes,具备多阶段构建、镜像体积优化经验,曾为公司的日志采集 Agent 编写 Dockerfile 将镜像从 1.2GB 压缩至 300MB,并编写 K8s DaemonSet 实现集群全节点自动部署。