awesome-search
该资源集合涵盖了搜索技术的多个方面,从基础的词法搜索到先进的语义搜索和混合搜索。重点关注了结果排序、个性化推荐和多样化等核心问题,同时也包含了实用的架构设计、测试方法和评估指标。项目收录了众多高质量的技术文章、视频教程和行业案例,为搜索领域的研究人员和工程师提供了全面的学习资料。
tct_colbert-msmarco
TCT-ColBERT是一个采用知识蒸馏技术的密集文档检索模型。该模型通过教师模型紧耦合方法,实现了BERT模型的轻量化,在维持检索效果的同时提高了运行效率。项目支持Pyserini框架集成,提供完整的模型实现代码。