•作为技术骨干参加全国大学生智能汽车竞赛,负责视觉感知模块,设计了一种融合多尺度特征的车道线检测网络,在复杂光照和磨损路段达到实时检测精度,助力团队获得华北赛区一等奖。
•在实验室期间,独立完成了一项关于医学影像中肿瘤小样本分割的研究,提出了基于原型网络与注意力机制的少样本学习框架,并在公开数据集上验证了泛化性能,整理出可复现的PyTorch代码库。
•曾参与校园AI创新工坊,面向安防场景开发轻量级人脸识别SDK,通过模型剪枝和量化将推理延迟降低50%,成果部署于校内门禁演示系统。
北京深瞳智能科技有限公司 - 算法研发部专精特新企业智能安防
2016.07-2019.12
•负责公司图像识别算法的研发与迭代,主导了基于深度学习的多标签场景分类项目。通过对海量监控视频帧数据的清洗与标注,设计并训练了多分支卷积网络,将场景分类准确率从 87%提升至 93%,为安防产品的智能检索功能提供了核心算法支撑。
•与硬件、嵌入式及产品团队紧密协作,推动图像识别能力在边缘计算盒子上的集成。在项目中,负责模型量化、剪枝及推理端适配,确保算法在低功耗设备上保持实时性与高精度,显著降低了端侧部署成本。
•持续跟踪视觉 Transformer 与自监督学习等前沿方向,定期组织内部技术研讨会,将最新的图像识别研究成果(如对比学习在少样本分类中的应用)引入公司研发流程,助力团队技术栈升级。
北京视界智能科技有限公司 - 算法研发中心创新型企业工业视觉解决方案
2020.01-至今
高级图像识别算法工程师工业缺陷检测算法架构团队管理
北京
•带领团队承担公司重点研发项目——基于图像识别的光伏面板缺陷检测系统。负责整体算法方案设计,采用改进的 YOLOv7 模型进行裂纹、断栅等微小缺陷的定位与识别。通过引入域自适应数据增强和伪标签策略,使缺陷检出率超过 97%,误检率控制在 2.5%以内,系统已部署于多个光伏电站,为客户节省了大量人工巡检成本。
•参与制定公司算法模块化开发规范,组织代码评审与技术文档沉淀。通过统一推理接口标准与构建自动化测试管线,使团队代码复用率提升 30%,新算法从方案到内测的周期缩短约 25%。
•与本地高校视觉实验室建立联合课题,探索工业场景下小样本缺陷分割的鲁棒性提升。在合作中,主导算法实验设计与工程验证,联合发表了一篇关于少样本工业异常检测的论文,增强了公司在智能制造领域的技术影响力。
•项目背景:线上服饰零售急需以图搜图能力来提升找同款效率。本项目旨在构建一个高精度服饰检索系统,降低用户搜索门槛。
•技术实现:以 EfficientNet 作为骨干网络,结合度量学习中的三元组损失函数来学习服饰图像的细粒度特征嵌入。采用多层级数据增强策略(如随机裁剪、颜色抖动、拼接),并引入注意力模块强化对领口、袖型等关键属性的表征。设计了基于 Faiss 的向量检索服务,实现亿级图库的毫秒级召回。
•项目成果:系统上线后,TOP-10 检索准确率达到 92%,搜索响应时间优于 0.3 秒。在内部 A/B 测试中,用户对拍照搜同款功能的满意度提升 35%,带动服饰类目转化率提升约 12%。
基于视频流的仓储物流异常行为识别系统 - 算法核心成员
2020.03-2021.06
•项目背景:大型仓储物流中心需要对人员违规操作、货物搬运异常等行为进行实时预警。本项目旨在开发一套基于视频流分析的智能化监控系统。
•技术实现:采用 3D 卷积网络与 SlowFast 结构捕捉视频片段中的时空特征,同时引入多目标跟踪算法(如 DeepSORT)关联人员轨迹。对异常行为(如抛扔快递、闯入禁区、长时间滞留)进行多标签分类建模,并利用时序平滑与后处理规则降低误报。
•项目成果:系统在真实仓储场景实测中,对典型异常行为的识别准确率达 88%,报警延迟低于 2 秒。该系统已作为标准化模块集成到公司物流安全平台,有效提升了监控中心的响应效率,降低了人工巡检强度。
开源项目参与:
在 GitHub 上发起并维护了“移动端实时目标检测工具箱”项目,专注于 YOLO 系列模型的移动端部署与量化加速。
该项目针对手机、嵌入式设备场景,提供了 FP16 量化脚本、NCNN 转换工具以及详细的性能调优指南,覆盖行人检测、车牌识别等常见任务。
目前项目已获得 260 余颗星标,被 80 多位开发者 Fork,并多次被社区推荐为移动端 AI 部署的参考实现。