Project Icon

INTERS

指令微调优化大型语言模型的搜索能力

INTERS是一个包含20个信息检索任务的指令微调数据集,旨在提升大型语言模型的搜索能力。该项目基于43个数据集构建,涵盖查询理解、文档理解和查询-文档关系理解三大类任务。实验表明,INTERS能有效增强LLaMA、Mistral等开源大型语言模型在信息检索方面的表现,为搜索技术发展开辟新路径。

TEXTOIR - 开放式意图识别的综合工具包
GithubTEXTOIR开放集分类开源项目意图识别聚类自然语言处理
TEXTOIR是一个专注于开放式意图检测和发现的综合工具包。它集成了最新算法,提供可扩展接口和统一数据设置,便于研究人员进行公平可复现的实验。该项目支持多个基准数据集,持续更新模型和方法,并配有可视化平台。TEXTOIR致力于推动文本开放意图识别领域的研究进展。
fine-tune-mistral - Mistral大语言模型全量微调开源项目
GithubHugging FaceMistral开源项目微调模型训练深度学习
fine-tune-mistral是一个专注于Mistral 7B大语言模型全量微调的开源项目。项目提供完整训练代码和使用说明,支持多GPU训练。其中包含多项训练技巧,如学习率调整和数据量建议等。项目还强调通过评估任务来衡量模型性能改进。该工具为研究者提供了一个进行Mistral模型定制化的便捷平台。
Splade_PP_en_v1 - SPLADE++稀疏文档检索模型的工业级优化实现
GithubHuggingfaceSPLADE++关键词扩展开源项目文档检索检索效率模型稀疏表示
基于SPLADE++的文档检索模型优化实现,通过FLOPS和令牌预算的调整实现高效检索。模型以bert-base-uncased为基础,在47.27ms的检索延迟下达到37.22的MRR@10性能,适合工业级搜索应用部署。
deep-seek - 大规模LLM驱动互联网检索引擎的实验性架构
DeepSeekGithub互联网安装开源项目检索引擎研究代理
该项目引入了一种基于LLM的大规模互联网检索引擎的实验性架构,与传统的答案引擎不同,它旨在处理大量来源,收集综合实体列表。项目展示了检索代理通过计划、搜索、提取和丰富等步骤生成包含信任评分的详细表格。该架构的亮点在于其高效的令牌使用和广泛的数据处理能力,适用于需要深入检索和详细信息的场景。用户可以访问示例结果,深入了解其架构特点和潜在改进空间。
MS-MARCO-Web-Search - 大规模网络数据集推动搜索与机器学习研究进展
GithubMS MARCO Web Search信息检索开源项目搜索引擎数据集机器学习
MS-MARCO-Web-Search是一个基于ClueWeb22的大规模网络数据集,包含数百万真实查询点击标签。它提供丰富的文本、视觉和语义信息,设置了嵌入模型、嵌入检索和端到端检索三个挑战任务。该数据集旨在推动机器学习和信息检索系统研究,并验证方法在大规模数据上的有效性。
InternEvo - 开源轻量级框架提升大规模模型训练效率
GithubInternEvo大语言模型开源项目性能优化预训练框架
InternEvo是一个轻量级开源训练框架,支持大规模预训练和单GPU微调。该框架在1024个GPU上达到近90%加速效率,适用于InternLM系列等大语言模型训练。通过集成高性能算子和Hybrid Zero技术,InternEvo优化了计算与通信效率,显著提升了训练性能。
internlm-xcomposer2d5-7b - 7B参数规模实现视觉语言理解和创作的开源多模态模型
GithubHuggingfaceInternLM-XComposer-2.5图像理解多模态开源项目模型网页生成长文本处理
InternLM-XComposer2.5采用7B参数规模构建,通过24K交错图文上下文训练,支持扩展至96K长文本理解。这个开源多模态模型在视频理解、多图对话、高清图像分析、网页生成和文章创作等场景中展现出强大的理解与创作能力。其优秀的长文本处理特性使其能够处理需要大量上下文的复杂任务。
BELLE - 推动中文大语言模型的开源发展与指令微调
BELLEGithub中文优化大语言模型开源社区开源项目指令微调
BELLE项目致力于推动中文对话大模型的开源发展,重点关注如何利用开源预训练大语言模型构建具有指令理解能力的个性化语言模型。该项目持续公开指令训练数据、模型、训练代码和应用场景,同时评估不同训练数据和算法对模型性能的影响。BELLE专门针对中文进行优化,仅采用ChatGPT生成的数据进行模型调优,不包含其他来源的数据。
distilbert-dot-tas_b-b256-msmarco - 基于平衡主题感知采样的高效密集检索方案
BERT_DotDistilBertGithubHuggingfaceMSMARCO开源项目文本检索模型知识蒸馏
本项目提供了一个基于DistilBERT的密集文本检索模型,采用双编码器结构和点积评分机制。该模型使用平衡主题感知采样(TAS-B)方法在MS MARCO数据集上训练,可用于候选集重排序或直接进行向量索引密集检索。模型在多个测试集上展现出优于BM25基线的检索性能。其特点包括高效训练(单GPU 48小时内完成)和保留原始DistilBERT的6层架构。这一方案为高效密集检索提供了新的解决思路。
LRV-Instruction - 通过稳健指令调优降低多模态模型幻觉风险
GPT4GithubLRV-InstructionMiniGPT4mplug-owl多模态模型开源项目
该项目通过稳健的指令调优,减少大规模多模态模型的幻觉现象,提升其在复杂视觉和语言任务中的表现。LRV-Instruction 数据集包含多种视觉和语言任务数据,通过 GPT-4 生成,提供正面和反面的指令示例,以提高模型的鲁棒性和准确性。最新的研究进展和更新内容不断推进多模态图表理解和图像上下文推理基准的发展,为相关领域提供重要的数据支持。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号