牛敬业
188****6389niu****@***.com北京30男生物信息工程师在职北京20k-30k •课程与实践覆盖基因组学、蛋白质组学及转录组学核心知识,熟练运用常用生信工具进行序列比对、变异检测与功能注释。
•参与多项科研课题,设计并实现针对特定生物学问题的分析流程,培养从数据清洗到结果解读的完整科研能力。
•关注机器学习在生物信息中的应用,尝试利用分类与聚类算法辅助疾病标志物筛选和样本分型。
北京某基因科技发展有限公司 - NGS数据分析部高新技术企业
2016.07-2019.12
•搭建并持续优化全外显子测序自动化分析流程,整合 FastQC、BWA、GATK 等工具,使每日数据处理量提升 40%
•承担 2000+ 例遗传病系谱样本的变异筛选与致病性评估,结合 ACMG 指南完成位点分级,支撑临床遗传咨询报告 300 余份
•与算法团队共同迭代低频突变检测模型,引入深度学习降噪策略,将阳性检出率提高 12%
北京某精准医疗科技集团 - 多组学研发中心科技领军企业
2020.01-至今
•主导构建多维度基因组变异知识库,整合 TCGA、COSMIC 等 8 个公共源,设计分层存储架构,实现 15TB 异构数据统一访问
•带领 6 人分析组完成 3 项肿瘤免疫治疗队列研究,运用外显子与转录组联合分析,筛选出 28 个潜在治疗靶点
•担任多家合作医院生信技术支持,制定数据交付标准,并通过版本化管理保障项目成果可溯源
•参与肿瘤早筛液体活检平台建设,负责 cfDNA 测序数据的比对、降噪与低频突变检测,优化背景错误校正模型,检出限低至 0.1%
•开发自动化 QC 报告与异常样本预警模块,累计处理 5000+ 例临床样本,ABN 样本召回率提升 15%
•结合公共数据库构建突变注释规则库,为报告解读团队提供精准位点分级依据
•主导构建药物基因组学变异知识图谱,整合 PharmGKB、ClinVar 等公共数据与自采样本,设计图数据库 Schema,支持变异-药物关联的语义检索
•带领团队开发自然语言处理流程,自动抽取文献中的变异-表型描述,构建百万级三元组,已服务于新药研发靶点筛选
•制定数据质控规范,实现多源数据溯源与版本管理,知识库获得 3 家合作单位采用
对生物数据背后的规律充满好奇,享受从序列到结论的推理过程;做事严谨细致,能沉下心处理高维组学数据与复杂算法。熟悉常用分析流程与公共资源,擅长为具体问题定制高效方案。喜欢跨学科协作,乐于将技术发现清晰地讲给非背景同事;希望在生物信息岗位持续挖掘数据价值。
生物信息分析与流程构建:
独立搭建基于容器技术的工作流管理系统,整合常用生信软件与数据库,支持多项目并行分析,并通过模块化设计降低维护成本。