INTERS

指令微调优化大型语言模型的搜索能力

INTERS是一个包含20个信息检索任务的指令微调数据集，旨在提升大型语言模型的搜索能力。该项目基于43个数据集构建，涵盖查询理解、文档理解和查询-文档关系理解三大类任务。实验表明，INTERS能有效增强LLaMA、Mistral等开源大型语言模型在信息检索方面的表现，为搜索技术发展开辟新路径。

Github

Huggingface

论文

介绍相关项目

internlm2-chat-7b - 70亿参数大模型实现20万字超长文本理解及多场景智能对话

GithubHuggingfaceInternLM2人工智能代码解释器大语言模型开源项目模型超长上下文

InternLM2-chat-7b作为书生·浦语第二代大模型的70亿参数版本，搭载20万字超长上下文理解技术，在复杂推理、数学运算、代码编程等核心任务上性能卓越。模型集成代码解释器和数据分析工具，通过增强型工具调用机制高效完成多步骤任务。在MMLU、AGIEval等主流评测基准上展现出同级别最优性能。该开源项目面向学术研究完全开放，同时提供免费商业授权渠道。

InRanker-base - 增强跨领域场景信息检索的AI解决方案

GithubHuggingfaceInRanker信息检索开源项目无监督学习模型模型蒸馏语言模型

InRanker通过语言模型和重排序技术，在无需额外查询或人工标注的情况下提升跨领域信息检索能力。其双重蒸馏训练策略有效生成训练数据，从而优化了模型性能，并保持易用特性。

LESS - 选择有影响力的数据进行有针对性的指令调整

GithubLESS开源项目指令微调数据选择模型训练评估

LESS项目提供了一种数据选择方法，通过选择有影响力的数据来增强特定功能。该项目涵盖了安装要求、数据准备、数据选择和模型训练的详细步骤，并提供相应的脚本和指南。通过预热训练、构建梯度数据存储库、任务数据选择和最终训练四个步骤，提升模型在下游任务中的表现能力。利用Flan v2、COT、Dolly和Open Assistant等训练数据集，以及MMLU、TydiQA和BBH等评估数据集，优化特定任务的模型性能。

tevatron - 神经检索模型训练与推理工具

GithubHuggingFaceLLM神经检索模型LoRA微调Mistral-7BTevatron开源项目

Tevatron提供高效工具包，支持在GPU和TPU上大规模训练和推理神经检索模型，集成DeepSpeed和LoRA等技术，可加载HuggingFace的预训练模型，适用于神经检索和开放域QA任务。

llm-toys - 微调小型语言模型实现多任务处理

Githubllm-toys任务微调低资源模型对话摘要开源项目语气变化

llm-toys 项目提供适用于释义、语气转换、对话总结和主题生成等任务的小型量化3B和7B语言模型。这些经过微调的模型能在普通消费级硬件上高效运行，并通过简单的安装步骤提升文本处理和生成能力。

interpret - 集合先进机器学习解释技术的开源工具包

EBMGithubInterpretML可解释性开源项目机器学习模型

InterpretML 是集合先进机器学习解释技术的开源工具包，使用户能训练可解释模型及分析黑箱系统。工具包支持模型调试、特征工程、公平性检测和人工智能协作等，帮助用户全方位理解模型行为并确保法规与高风险应用的合规性。通过实例展示，InterpretML 不仅增强了模型透明度，也提高了其可信度。

jina-reranker-v2-base-multilingual - 高性能多语言文本重排序模型优化信息检索效果

GithubHuggingfacejina-reranker-v2-base-multilingual多语言开源项目搜索相关性文本重排序模型跨编码器

jina-reranker-v2-base-multilingual是一款优化文本重排序的多语言transformer模型。它支持多语言查询-文档对处理、长文本输入和闪存注意力机制，在文本检索、多语言处理、函数调用和SQL重排序等基准测试中表现卓越。该模型能显著提升信息检索系统的性能和准确度。

LLM-FineTuning-Large-Language-Models - LLM微调实践与技术应用指南

Fine-tuningGithubLLMPEFTQLoRA开源项目量化

本项目介绍了如何使用ORPO、QLoRA、GPTQ等技术对大型语言模型（LLM）进行微调，包含具体实例和代码片段。项目还提供与这些技术相关的YouTube视频链接，提供全面的学习资料。此外，项目还包含各类实用工具和技术说明，帮助用户更好地理解和应用这些前沿技术。适合有一定编程基础的研究人员和开发者参考。

ToolBench - 大规模工具使用指令数据集与开源语言模型

AI工具APIGithubToolBench大规模语言模型工具使用能力开源项目

ToolBench项目构建了大规模的指令微调数据集，旨在提升语言模型的工具使用能力。该项目收集了16464个真实API，覆盖单工具和多工具场景，采用深度优先搜索决策树方法生成注释。项目提供训练脚本和微调后的ToolLLaMA模型，其工具使用能力达到了与ChatGPT相当的水平。

bert-multilingual-passage-reranking-msmarco - BERT多语言文本重排序模型优化搜索效果

BERTGithubHuggingface多语言开源项目搜索引擎机器学习模型模型训练

这是一个支持100多种语言的BERT段落重排序模型,通过对搜索查询和文本段落的语义匹配分析,可将搜索结果相关性提升61%。模型在MS MARCO数据集上训练,可无缝集成到Elasticsearch中,适用于多语言搜索优化场景。实测表明,其在英语性能与单语模型相当,在德语等其他语言上表现更优。

相关项目

推荐项目

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com