CV
AMAZING RESUME
牛敬业 AI加速FPGA工程师
139****2851 niu****@***.com 北京 32 男 AI加速FPGA工程师 在职 北京 30k-40k • 主修高等数字系统设计、可重构计算与异构加速等前沿课程,荣获研究生创新基金资助,平均成绩专业前5%。
• 作为硬件加速竞赛团队队长,设计基于FPGA的轻量级神经网络推理加速器,独立完成卷积算子Verilog编码与板级吞吐量测试,实现端到端硬件部署。
北京地平线机器人技术研发有限公司 - AI加速芯片研发部 AI芯片独角兽 边缘计算领先企业
2016.07-2021.06
AI加速FPGA工程师 AI推理加速 FPGA板卡设计 系统架构
北京
• 负责公司面向云端AI推理的FPGA加速卡产品定义与架构设计,主导了一款基于多FPGA互联的加速方案,在自然语言处理模型推理中吞吐量提升2倍,成功部署于头部互联网企业的推荐系统平台,年度营收贡献超8000万元。
• 与算法团队协同,针对Transformer、推荐模型等算法进行FPGA算子优化,采用脉动阵列、数据流重构等技术,将模型推理延迟压缩了70%以上。
• 构建了从RTL设计到板级验证的标准化开发流程与代码评审机制,主导了多个复杂项目的交付,培养了5名FPGA开发工程师。
烽火通信科技股份有限公司 - 无线产品研发部 通信设备供应商 光通信龙头企业
2014.07-2016.06
• 参与5G NR基站FPGA基带处理板卡开发,负责上行控制信道与数据信道的FPGA实现,通过并行流水线与资源复用技术,将处理时延从0.5ms降至0.3ms,功耗降低25%,成功应用于三大运营商5G试验网。
• 负责团队FPGA仿真验证平台与自动化测试框架的搭建,编写了全面的设计文档与回归测试用例,开发效率提升30%。
• 与射频、硬件团队紧密配合,完成FPGA与高速ADC/DAC的JESD204B接口调试,确保系统级互连可靠。
自动驾驶视觉感知FPGA加速卡开发 - FPGA算法实现工程师
2017.01-2018.12
• 项目背景:随着自动驾驶等级提升,车载感知系统对实时性与功耗提出严苛要求,传统GPU方案难以满足车规级功耗约束,因此需要开发基于FPGA的高能效AI推理加速方案。
• 项目内容:作为算法实现负责人,负责目标检测、语义分割等CNN网络在FPGA上的部署与优化。采用层间流水线、卷积循环展开、权重定点量化等技术,最大化利用片上DSP与内存带宽,并设计双缓冲存储结构以消除数据搬运瓶颈。
• 项目成果:成功交付一款面向自动驾驶的AI加速板卡,在典型视觉感知模型上,推理性能达到同等算力GPU的2.5倍,功耗仅15W,通过车规级环境测试,已搭载于多家整车厂的L4级自动驾驶样车,累计路测里程超百万公里。
5G NR基站基带FPGA模块开发 - FPGA算法实现工程师
2014.07-2016.06
• 项目背景:随着5G NR标准冻结,大规模MIMO和更高载波频率对基带处理引入巨大算力挑战,FPGA以其可重构特性成为基带信号处理的核心平台。
• 项目内容:负责PUSCH/PUCCH信道编解码及速率匹配模块的FPGA实现,对LDPC译码器进行迭代调度优化与并行度设计,利用流水线技术与矩阵分块运算将译码吞吐率提升至1.2Gbps。配合硬件团队完成FPGA与射频前端、DSP的CPRI/eCPRI接口时序收敛与板级调试。
• 项目成果:成功交付5G NR基带处理FPGA模块,端到端处理时延不超过0.4ms,功耗较上一代方案降低35%,通过中国信通院5G基站功能验证,已集成于多款商用5G宏基站,支撑了运营商大规模部署。
对高性能计算与通信基带处理始终抱有技术热情,习惯从架构层面审视软硬件协同,喜欢在 RTL 设计里追求时序收敛与资源效率的平衡。工程上自驱且严谨,善于在复杂系统集成中识别边界风险并提前闭环,抗压与交付意识强。十年 FPGA 实战积累了扎实的硬件实现功底,对流水线优化、片上存储调度及 AI 算子硬化有深度理解,能快速适配新协议与算法框架。持续关注异构计算趋势,享受用逻辑设计解决性能瓶颈,目标在 AI 推理加速与无线通信领域持续深耕。
专利:
拥有4项授权发明专利,覆盖低功耗AI加速器流水线调度、可重构基带处理架构等方向,如《面向边缘场景的动态稀疏神经网络加速器》《一种基于FPGA的5G NR极化码译码器》等。
相关专利已成为公司自研加速卡与基站处理单元的核心技术,支撑产品在低时延与高吞吐场景下的性能优势。