•在实践环节中,主导“基于FPGA的实时语音采集与存储系统”课程设计,完成模数转换、FIFO缓存与SD卡写入,获院级优秀项目。
•作为核心成员参与“智能语音开关”创新训练项目,设计基于低功耗MCU的语音指令识别电路,实现本地离线控制,积累硬件集成经验。
•凭借综合学业表现,连续三年获校级学习优秀奖学金,并获评校级优秀毕业生。
北京云知声信息技术有限公司 - 智能语音事业部人工智能创新企业语音技术前沿
2016.07-2019.12
语音识别系统集成工程师语音识别系统集成技术交付
北京
•主导智慧医疗语音交互系统的集成方案设计,与多家医疗设备厂商对接,完成手术室语音控制模块的适配,确保系统在高噪声环境下稳定运行。
•针对嵌入式语音识别芯片,应用模型蒸馏与量化技术,将识别模型体积压缩40%,在低功耗MCU上实现实时响应,语音唤醒率提升至98%,误唤醒率降低0.5次/天。
•带领团队交付某大型银行智能语音客服系统,最高日处理呼叫量达50万通,通过持续优化声学模型和业务逻辑,最终客户满意度达99%。
•编写《语音识别系统集成实战指南》,并作为内部讲师开展技术分享,累计培训新人60余人次,推动团队技术标准化。
腾讯科技(深圳)有限公司 - 智慧出行事业部互联网领军企业AI技术领先
2020.01-2022.12
语音识别系统集成工程师车载语音系统测试方案架构
北京
•主导智能座舱语音助手集成项目,与高通、比亚迪等合作,完成车载环境的声学调试,实现语音控制空调、车窗、导航等,并支持离线命令,量产车型达15万辆。
•搭建全场景语音测试平台,模拟高速风噪、多人对话、儿童发音等复杂场景,累计发现并修复语音识别兼容性问题42个,将系统鲁棒性提升至新高度。
•与产品、设计团队协同,推动语音助手连续对话功能上线,并新增10种方言唤醒词,使日活用户语音交互频次提升25%。
•主导撰写《车载语音集成最佳实践》白皮书,并搭建内部知识库,沉淀常见问题及解决方案,为后续项目提供参考。
某智能医疗语音交互系统集成项目 - 系统集成工程师
2017.05-2018.03
•该项目为某三甲医院智能语音电子病历系统集成,作为核心成员参与需求调研、声学环境评估及技术方案设计。
•与医疗设备厂商及医院信息系统对接,实现语音识别与电子病历、检查报告系统的无缝集成,支持医生在手术中语音录入诊断信息。
•针对病房环境噪声,采用自适应波束成形与深度神经网络降噪,并优化模型在嵌入式终端的推理速度,语音识别延迟低于0.3秒,满足实时记录需求。
•系统上线后,在试点科室,医生语音录入效率提升40%,识别准确率在带口音场景下仍保持94%以上,随后推广至全院。
•参与智能翻译笔系统集成项目,负责语音采集前端与翻译引擎的接口适配,确保离线与在线翻译模式的平滑切换。
•针对中英日韩四种语言,细分口音样本训练声学模型,并加入语言模型自学习机制,使混合语言识别准确率提升至90%。
•设计低延迟数据通道,实现语音识别结果与翻译模块的异步交互,并通过TTS合成输出,端到端翻译延迟控制在800毫秒以内。
•产品上市后,在京东、天猫等平台获得用户好评,语音翻译准确性与响应速度成为核心卖点,首月销量突破5万台。
技术社区与工程实践:
定期追踪ICASSP、Interspeech等会议中关于低资源语音识别、边缘部署优化等方向的最新工作,并在Jetson Nano上复现过轻量级语音增强模型。
运营个人技术博客,系统记录系统集成中的硬件调优、驱动适配与声学调试经验,已发布近40篇原创内容,与嵌入式声学社区保持互动。