doremi

创新算法提升语言模型训练效率

DoReMi 语言模型数据混合优化分布鲁棒优化代理模型 Github 开源项目

DoReMi是一种优化语言模型数据集混合的算法。它通过分布鲁棒优化调整数据混合，适应不同目标分布。算法训练小型代理模型动态调整各领域数据权重，并利用预训练参考模型避免对高熵领域过于悲观。DoReMi显著提高大型模型训练效率，如280M代理模型可使8B参数模型达到基线性能的速度提高2.6倍。项目提供PyTorch实现，包含快速可恢复的数据加载器和下游评估工具。

Github

介绍相关项目

llama-3-8b-bnb-4bit - 大语言模型微调工具提升训练速度并降低内存使用

AI训练GithubHuggingfaceLlama 3MetaUnsloth大语言模型开源项目模型

llama-3-8b-bnb-4bit项目是一种高效的大语言模型微调方法,能将训练速度提升2-5倍,同时减少70%内存使用。支持Llama 3.1、Gemma 2和Mistral等热门模型,并提供面向初学者的Google Colab笔记本。用户可以快速微调模型并导出为GGUF、vLLM格式或上传至Hugging Face。该工具降低了LLM微调的门槛,为开发者和研究者提供了便利。

llama-3-8b-Instruct - 开源大模型训练工具实现显著提速与内存优化

GithubHuggingfaceLlama-3内存优化开源项目性能优化模型模型微调深度学习

基于4bit量化技术的开源大语言模型训练工具，为Mistral、Gemma、Llama等主流模型提供优化方案。项目通过技术创新实现训练速度提升2-5倍，内存占用降低70%。支持GGUF格式导出和Hugging Face部署，提供多个免费Colab训练环境，降低了模型训练的硬件门槛。

Megatron-DeepSpeed - 分布式训练框架助力大规模语言模型预训练

DeepSpeed配置GPT预训练GithubMegatron-DeepSpeed分布式训练开源项目预处理数据

Megatron-DeepSpeed是一个集成DeepSpeed的大规模语言模型预训练框架。它支持多GPU和多节点分布式训练,提供数据预处理、预训练、微调和下游任务评估等完整流程。该框架针对BERT、GPT等模型优化,实现高效大规模训练。集成DeepSpeed的流水线并行和ZeRO-DP技术,进一步提升训练效率和灵活性。

m2 - 子二次GEMM架构Monarch Mixer实现高效语言模型

GithubM2-BERTMonarch Mixer人工智能开源项目机器学习自然语言处理

Monarch Mixer是一种创新的子二次GEMM架构，用于训练序列长度和模型维度均为子二次的语言模型。该架构使用Monarch矩阵层替代Transformer中的注意力和MLP操作，提高了计算效率。基于此架构的M2-BERT模型在减少25%参数和计算量的同时，在GLUE基准测试中达到了与BERT相当的性能。项目开源了预训练模型权重以及预训练和微调代码，方便研究者进行further研究。

NeuralDaredevil-8B-abliterated - 优秀的开源8B参数量大语言模型，在Open LLM排行榜中领先

GithubHuggingfaceNeuralDaredevil-8B人工智能开源项目模型模型评估深度学习语言模型

NeuralDaredevil-8B-abliterated是一个经过DPO微调的8B参数量大语言模型。该模型通过abliteration过程和orpo-dpo-mix-40k数据集训练，成功恢复并提升了性能。在Open LLM Leaderboard上，其MMLU得分领先同级别模型。模型支持GGUF、EXL2、AWQ等多种量化版本，适用于角色扮演等无需对齐的应用场景。在AGIEval、GPT4All等多项评测中，NeuralDaredevil-8B-abliterated均展现出优异表现，是目前表现最佳的开源8B参数量语言模型之一。

LLamaTuner - 大语言模型微调工具，支持几乎所有GPU

GithubLLamaTunerSupervised fine-tuning dataset大语言模型开源项目数据预处理模型训练

LLamaTuner是一款高效、灵活且功能全面的大语言模型微调工具。支持在几乎所有GPU上进行大语言模型的预训练和微调，包括单个8GB GPU上微调7B LLM和超过70B模型的多节点微调。自动调度高性能算子如FlashAttention和Triton内核，兼容DeepSpeed以提升训练吞吐量。支持多种LLM和VLM，以及QLoRA和LoRA等多种训练算法，提供连续预训练、指令微调和代理微调等功能，还能与大型模型进行对话。

REST - 创新检索式推测解码加速大语言模型生成

GithubREST开源项目推测解码推理加速检索式生成语言模型

REST是一种创新检索式推测解码方法，利用数据存储检索草稿令牌以加速大语言模型生成。无需额外训练，可即插即用于现有语言模型。在HumanEval和MT-Bench测试中，REST展现显著速度提升，为提高大语言模型效率开辟新途径。

dolphin-2.7-mixtral-8x7b - 灵活的AI模型助力编码任务，增强开发效能与合规

DolphinGithubHuggingfaceMixtral图灵测试开源项目模型编程训练模型

Dolphin 2.7是Dolphin-2.5/2.6的升级版，通过transformers库的Mixtral修正和门层调整，提升了性能。该模型在编码任务中表现优异，同时进行去偏见处理以提高合规性。需注意模型对用户请求的高度顺从性，建议用户自行设置合规层确保安全。项目由Convai资助，适用于多种高效和合规的AI应用。

Multi-LLM-Agent - 多模型协作系统提升小型语言模型工具学习效能

GithubMulti-LLM Agentα-UMi人工智能大语言模型工具学习开源项目

α-UMi是一个创新的多模型协作系统，将语言模型能力分解为规划、调用和总结三个组件。通过全局到局部的渐进式微调策略和灵活的提示设计，该系统显著提升了小型语言模型在工具学习任务中的表现，甚至超越了某些大型闭源模型。α-UMi为复杂AI任务提供了新的高效解决方案。

DARE_TIES_13B - 通过合并多种预训练语言模型提升AI性能

DARE_TIES_13BGithubHuggingface大模型开源项目模型算法合并语言模型配置文件

项目通过DARE TIES方法合并预训练语言模型，使用yunconglong的Truthful DPO TomGrc FusionNet 7Bx2 MoE 13B作为基础，结合了13B DPO及13B MATH DPO模型。通过密度和权重配置，采用bfloat16和int8掩码，在计算效率和文本覆盖上均有显著提升。

相关项目

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计是一个多功能的在线设计和创意平台，提供广泛的设计工具和资源，以满足不同用户的需求。从专业的图形设计师到普通用户，无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑，稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合，帮助用户轻松实现创意设计。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号