
扫码联系客服

在《CUDA编程实践》课程中开发自定义卷积核模板库,将特征图处理吞吐量提升3.2倍,相关代码被收录进课程官方示例仓库。
以核心成员身份参与国家虚拟仿真实验项目,搭建支持混合精度训练的云端实验平台,服务300+师生开展深度学习模型验证。
主导智能交通监控系统的模型轻量化改造,通过混合精度训练与动态量化技术,将YOLOv8模型在嵌入式视觉处理单元上的推理帧率提升65%,功耗降低至原方案的40%。
设计跨平台部署中间件,打通PyTorch模型到Jetson Orin/NVIDIA DRIVE平台的自动转换流程,将算法交付周期从2周压缩至3个工作日。
与车规级芯片厂商联合调优神经网络引擎,针对自动驾驶感知模块的实时性需求,实现多任务模型融合的延迟控制在18ms以内。
负责智慧医疗影像云平台的核心模型交付,创新性引入知识蒸馏+神经架构搜索组合方案,将3D病理切片分割模型参数量压缩72%的同时保持98.5%的Dice系数。
构建分布式推理调度系统,动态分配GPU集群资源处理CT/MRI影像分析任务,支持日均20万+病例的并发处理能力,系统可用性达99.99%。
主导完成医疗AI产品从研发环境到HIS/PACS系统的无缝集成,设计符合HIPAA标准的数据流加密方案,通过三甲医院等保三级认证。
**项目背景**:为某省级农业监测平台开发移动端的实时病虫害识别服务,需适配低端安卓设备且支持离线推理。
- 创新性采用MobileNetV3+OpenVINO联合优化方案,将ResNet50模型体积压缩至8.2MB,在骁龙665芯片上实现32FPS推理速度。
- 设计增量学习框架,支持农户端模型按需更新,通过联邦学习机制保护敏感农业数据隐私。
**项目成果**:系统覆盖全国12个省份的320万亩农田,错误识别率较传统方法降低68%,获农业农村部创新应用一等奖。
**项目背景**:针对钢铁企业产线的高精度缺陷检测需求,需解决高亮反光与微小划痕识别难题。
- 提出多尺度特征融合策略,结合张量RT加速引擎,将缺陷定位精度提升至99.2%(F1分数),检测速度达2000张/分钟。
- 搭建边缘计算网关实现模型热更新机制,单次产线停机时间控制在15分钟内。
**项目成果**:系统在宝钢集团某钢厂全面部署,年减少废品损失超1800万元,获工信部智能制造优秀案例认证。
专注AI模型从实验室到产业落地的最后一公里,痴迷于在算力约束下榨取每瓦性能。习惯用硬件工程师的思维拆解算法瓶颈,擅长在嵌入式设备与云端集群间搭建高效推理链路。对模型压缩与异构计算充满热情,追求在精度损失最小化的同时实现极致速度突破。常保持代码洁癖,坚持部署方案可复现、可监控、可扩展的工程原则,期待在智能制造与智能驾驶领域持续创造技术价值。
向PyTorch生态社区提交19项技术改进提案,重点实现TensorRT-ONNX转换工具链的算子对齐方案,修复17个跨平台部署兼容性问题。
编写《高效模型推理实践手册》(含移动端/边缘端部署案例),系统性解析算子融合策略与内存管理机制,累计获得2.1万次技术论坛引用。

在《CUDA编程实践》课程中开发自定义卷积核模板库,将特征图处理吞吐量提升3.2倍,相关代码被收录进课程官方示例仓库。
以核心成员身份参与国家虚拟仿真实验项目,搭建支持混合精度训练的云端实验平台,服务300+师生开展深度学习模型验证。
主导智能交通监控系统的模型轻量化改造,通过混合精度训练与动态量化技术,将YOLOv8模型在嵌入式视觉处理单元上的推理帧率提升65%,功耗降低至原方案的40%。
设计跨平台部署中间件,打通PyTorch模型到Jetson Orin/NVIDIA DRIVE平台的自动转换流程,将算法交付周期从2周压缩至3个工作日。
与车规级芯片厂商联合调优神经网络引擎,针对自动驾驶感知模块的实时性需求,实现多任务模型融合的延迟控制在18ms以内。
负责智慧医疗影像云平台的核心模型交付,创新性引入知识蒸馏+神经架构搜索组合方案,将3D病理切片分割模型参数量压缩72%的同时保持98.5%的Dice系数。
构建分布式推理调度系统,动态分配GPU集群资源处理CT/MRI影像分析任务,支持日均20万+病例的并发处理能力,系统可用性达99.99%。
主导完成医疗AI产品从研发环境到HIS/PACS系统的无缝集成,设计符合HIPAA标准的数据流加密方案,通过三甲医院等保三级认证。
**项目背景**:为某省级农业监测平台开发移动端的实时病虫害识别服务,需适配低端安卓设备且支持离线推理。
- 创新性采用MobileNetV3+OpenVINO联合优化方案,将ResNet50模型体积压缩至8.2MB,在骁龙665芯片上实现32FPS推理速度。
- 设计增量学习框架,支持农户端模型按需更新,通过联邦学习机制保护敏感农业数据隐私。
**项目成果**:系统覆盖全国12个省份的320万亩农田,错误识别率较传统方法降低68%,获农业农村部创新应用一等奖。
**项目背景**:针对钢铁企业产线的高精度缺陷检测需求,需解决高亮反光与微小划痕识别难题。
- 提出多尺度特征融合策略,结合张量RT加速引擎,将缺陷定位精度提升至99.2%(F1分数),检测速度达2000张/分钟。
- 搭建边缘计算网关实现模型热更新机制,单次产线停机时间控制在15分钟内。
**项目成果**:系统在宝钢集团某钢厂全面部署,年减少废品损失超1800万元,获工信部智能制造优秀案例认证。
专注AI模型从实验室到产业落地的最后一公里,痴迷于在算力约束下榨取每瓦性能。习惯用硬件工程师的思维拆解算法瓶颈,擅长在嵌入式设备与云端集群间搭建高效推理链路。对模型压缩与异构计算充满热情,追求在精度损失最小化的同时实现极致速度突破。常保持代码洁癖,坚持部署方案可复现、可监控、可扩展的工程原则,期待在智能制造与智能驾驶领域持续创造技术价值。
向PyTorch生态社区提交19项技术改进提案,重点实现TensorRT-ONNX转换工具链的算子对齐方案,修复17个跨平台部署兼容性问题。
编写《高效模型推理实践手册》(含移动端/边缘端部署案例),系统性解析算子融合策略与内存管理机制,累计获得2.1万次技术论坛引用。
奇秒简历AmazingCV 深度学习部署工程师 简历免费在线制作,包含深度学习部署工程师简历范文,深度学习部署工程师简历求职模板,AI辅助一键优化深度学习部署工程师简历内容,秒变满分候选人,让心动offer拿到手软。贴合HR筛选偏好,告别千篇一律,简历通过率飙升。