AMAZING RESUME
牛敬业
高级搜索算法后端开发
188****1111niu****@***.com北京32男高级搜索算法后端开发在职北京30k-50k •在《信息检索与搜索引擎》课程中,作为组长带队实现了一个基于倒排索引与BM25的新闻搜索引擎,并引入PageRank变体对结果排序,答辩获评年度优秀课程设计。
•担任实验室学生负责人期间,组织团队参加国际数据挖掘竞赛KDD Cup,负责召回与排序模块,设计基于双塔模型的语义检索方案,最终在任务赛道中进入全球前4%。
•主导开发了面向科研场景的文献检索与推荐平台,利用Elasticsearch搭建分布式索引集群,并嵌入基于Sentence-BERT的向量检索能力,系统日均处理复合查询超过3000次,成为个人后端与算法结合的重要实践样本。
字节跳动 - 搜索与推荐技术部互联网大厂技术驱动全球化业务
2017.07-2022.06
高级搜索算法后端开发工程师搜索架构算法优化团队管理向量检索
北京
•主导公司搜索算法后端系统的整体架构演进,引入向量化召回与语义匹配技术,针对多地域、多业务线的复杂场景重构搜索策略,使核心搜索召回率提升22%,准确率提升18%。
•带领7人算法后端团队完成从0到1的搜索中台建设,攻克了千亿级索引实时更新、千万级QPS下的超低延迟分发等难题,项目提前两周上线,系统稳定性获得业务方一致好评。
•与产品、运营团队深度协同,将模糊的“搜索结果更懂用户”诉求转化为可量化的技术指标,落地了基于用户实时意图的动态排序方案,支撑了业务线月度活跃用户增长40%的目标。
美团 - 搜索与数据平台部生活服务巨头业务多元化技术密集型
2014.07-2017.06
搜索算法后端开发工程师高性能接口索引存储稳定性保障性能调优
北京
•参与生活服务搜索平台的后端开发,设计并实现了支持多业态融合的搜索服务接口,通过对接口协议的精准抽象和缓存策略优化,使接口平均响应时间降低35%,支撑了外卖、到店等核心场景的爆发式增长。
•重构商品与服务索引的存储结构,采用分层索引与热点数据预加载机制,将复杂查询的搜索速度提升45%,大幅改善了用户在地图模式下的即时搜索体验。
•搭建全链路性能监控与自动容灾体系,通过压测分析定位了多个隐蔽的GC停顿与网络抖动问题,推动系统可用性达到99.99%,保障了高峰时段的交易顺畅。
•该项目旨在为本地生活平台构建一套融合文本、地理位置与用户画像的智能搜索引擎,提供从“找店”到“找服务”的精准匹配。我负责核心检索链路的算法设计与实现。
•设计并实现了基于双塔模型的地理语义联合嵌入算法,将商户描述、用户评价与实时位置信息映射到统一向量空间,使搜索的地理相关性提升30%,用户到店转化率提升20%。
•重构了排序层的多目标优化策略,将点击率、下单率、距离衰减等信号融合为统一的效用函数,并引入在线学习框架动态调整权重,推动整体交易额提升12%。
•主导了引擎的轻量化改造,通过模型量化与索引压缩技术,将搜索延迟控制在50ms以内,成功支撑了2000万日活用户的并发检索需求。
•该系统面向金融机构内部,利用知识图谱技术对海量非结构化风险数据进行关联搜索,辅助分析师快速识别潜在风险。我负责搜索后端及图索引的构建与优化。
•构建了基于图嵌入的语义索引,将企业、人员、事件等实体及其关系以图结构存储,实现了对复杂关联路径的亚秒级搜索,搜索速度较传统方案提升65%。
•开发了可配置的规则推理引擎,支持用户自定义风险传导路径,结合知识图谱的深度关系推理,将风险发现覆盖率提高35%,有效降低了人工排查成本。
•参与系统从离线到在线服务的全流程交付,通过压力测试与灰度发布确保了系统平稳上线,上线后支撑了每日数十万次的风险查询,成为风控部门核心工具。
对搜索技术抱有浓厚兴趣,享受从倒排索引到排序策略的每一层优化,对系统延迟和召回质量有近乎偏执的要求。长期保持代码洁癖与工程规范意识,坚信可维护性决定了服务的天花板。在团队中更倾向于充当难题终结者,善于把握复杂问题的关键路径,并能清晰拆解给不同角色达成共识。期待在搜索算法后端岗位上持续精进,用技术让信息获取更精准自然。
开源项目与技术分享:
向Apache Lucene社区提交了关于索引段合并策略的优化代码,通过动态调整合并阈值,有效降低了写入放大效应,相关改动被合并至8.x主线版本。
独立设计并开源了轻量级搜索工具库“SearchLite”,在单机环境下整合了倒排索引与HNSW向量检索,支持混合查询与在线BM25调参,在GitHub上获得超过1200 Star,被多个初创团队用于知识库搜索的快速原型开发。