leandojo-lean4-retriever-byt5-small

利用检索增强模型改进定理证明技术

LeanDojo 开源项目检索增强模型 Github 语言模型定理证明 NeurIPS Huggingface

LeanDojo项目应用检索增强的语言模型，旨在提升数学与逻辑推理中的自动化水平。通过自然语言处理和机器学习的结合，LeanDojo为定理证明提供了高效创新的解决方案，显著提高了检索精度并加速了复杂问题的求解。目前，该项目正在NeurIPS会议的Datasets and Benchmarks Track中评审，适用于研究人员扩大在数学领域应用机器学习的探索。详情请访问LeanDojo官方网站。

访问官网

Huggingface

介绍相关项目

self-speculative-decoding - 无损加速大型语言模型的创新推理方案

GithubLLM加速Self-Speculative Decoding层跳过开源项目推理优化草稿验证

Self-Speculative Decoding是ACL 2024的一个开源项目，提出了一种无损加速大型语言模型（LLMs）的新方法。该技术通过草稿生成和验证两个阶段，在不增加额外训练和内存的情况下提高LLM推理速度。这一创新方案保证了输出质量和模型兼容性，为LLM加速提供了高效且易于实施的解决方案。

tevatron - 神经检索模型训练与推理工具

GithubHuggingFaceLLM神经检索模型LoRA微调Mistral-7BTevatron开源项目

Tevatron提供高效工具包，支持在GPU和TPU上大规模训练和推理神经检索模型，集成DeepSpeed和LoRA等技术，可加载HuggingFace的预训练模型，适用于神经检索和开放域QA任务。

efficient-splade-VI-BT-large-doc - SPLADE模型实现高效文档检索与精准排序

GithubHuggingfaceSPLADE信息检索开源项目效率优化文档编码器检索模型模型

SPLADE模型是一种针对文档检索的高效架构,采用查询和文档推理分离设计。该模型在MS MARCO开发集上达到38.0 MRR@10和97.8 R@1000的性能,同时将推理延迟降至0.7毫秒。它在保持与先进神经排序器相近效果的同时,大幅缩短了延迟,接近传统BM25的速度,为文档检索领域提供了平衡效率与准确性的新方案。

DeepSeek-LLM - 多语言大模型展现卓越编码与数学能力

DeepSeek LLMGithub人工智能开源开源项目自然语言处理语言模型

DeepSeek LLM是一个包含67亿参数的先进语言模型,经过2万亿英文和中文token的训练。该模型在推理、编码、数学和中文理解等方面表现优异,超越多个同类模型。其67B Chat版本在编码和数学方面尤为出色,在HumanEval和GSM8K等基准测试中名列前茅。项目开源了7B和67B的base与chat版本,可用于学术和商业研究。

Yi-1.5-6B-Chat - 提升代码、数学、推理能力的开源AI模型

GithubHuggingfaceYi-1.5基准测试开源项目数学推理模型语料库语言理解

Yi-1.5在编码、数学、推理和指令执行方面表现卓越，其通过训练5000亿高质量语料和300万多样化样本的微调实现了更强的表现。同时，Yi-1.5-6B-Chat等多个模型版本提供了不同的上下文长度以适应各种应用场景需求。这些模型在基准测试中表现优异，并且在同尺寸开源模型中领先。用户可通过Hugging Face、ModelScope等平台获取模型资源，快速应用于项目中。

doremi - 创新算法提升语言模型训练效率

DoReMiGithub代理模型分布鲁棒优化开源项目数据混合优化语言模型

DoReMi是一种优化语言模型数据集混合的算法。它通过分布鲁棒优化调整数据混合，适应不同目标分布。算法训练小型代理模型动态调整各领域数据权重，并利用预训练参考模型避免对高熵领域过于悲观。DoReMi显著提高大型模型训练效率，如280M代理模型可使8B参数模型达到基线性能的速度提高2.6倍。项目提供PyTorch实现，包含快速可恢复的数据加载器和下游评估工具。

alphageometry - 无需人类示范的奥林匹克几何问题求解器

AlphaGeometryGithub人工智能几何定理证明开源项目数学奥林匹克机器学习

AlphaGeometry是一个创新的几何定理证明系统，能够解决奥林匹克级别的几何问题，无需人类示范。它结合了演绎-归纳推理和大型语言模型，自动构建辅助线并生成严格证明。在IMO-AG-30和JGEX-AG-231测试集上，AlphaGeometry分别解决了25和228个问题，大幅超越传统DDAR方法。项目开源了核心代码，包括DDAR求解器和语言模型推理模块，为几何定理自动证明开辟新路径。

MAmmoTH2-7B-Plus - 增强大型语言模型推理能力的创新研究

GithubHuggingfaceMAmmoTH2大语言模型开源项目指令微调数学推理模型

MAmmoTH2项目通过创新的指令微调技术，提升大型语言模型在推理基准上的显著表现。该项目高效采集了来自预训练网络语料的1000万条指令-响应对，成功开发出无需特定领域数据且在MATH与GSM8K基准上表现优异的模型。MAmmoTH2-Plus进一步基于公共数据进行训练，在推理与聊天机器人领域设定了新标准。本项目展示了一种获取大规模优质指令数据的高性价比方法，提供了增强大型语言模型推理能力的全新视角。

Multi-Agents-Debate - 多智能体辩论框架激发大语言模型发散思维能力

AI辩论GithubMulti-Agent Debate大语言模型开源项目认知行为语言模型

该项目提出创新的多智能体辩论框架，激发大语言模型发散思维能力。通过模拟辩论过程，有效克服自我反思中可能出现的思维退化问题。实验显示，此方法在反直觉问答和常识机器翻译等任务中带来显著持续改进。项目探索大语言模型间交互和辩论能力，为人工智能领域开辟新研究方向。

reasoning-on-graphs - 基于大语言模型和知识图谱的忠实可解释推理

GithubReasoning on GraphsRoG大型语言模型开源项目知识图谱解释性推理

利用大语言模型与知识图谱，提供优化的规划-检索-推理框架，实现忠实与可解释的推理。预训练权重和自动下载的数据集简化了关系路径生成和答案推理过程，并支持多种大语言模型的插拔式推理，使推理结果更具解释性和灵活性。

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

Project Cover

稿定AI

稿定设计是一个多功能的在线设计和创意平台，提供广泛的设计工具和资源，以满足不同用户的需求。从专业的图形设计师到普通用户，无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑，稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合，帮助用户轻松实现创意设计。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号