Project Icon

InternEvo

开源轻量级框架提升大规模模型训练效率

InternEvo是一个轻量级开源训练框架,支持大规模预训练和单GPU微调。该框架在1024个GPU上达到近90%加速效率,适用于InternLM系列等大语言模型训练。通过集成高性能算子和Hybrid Zero技术,InternEvo优化了计算与通信效率,显著提升了训练性能。

BMTrain - 分布式大规模深度学习模型训练优化工具
BMTrainGithubZeRO优化分布式训练大模型训练开源项目性能优化
BMTrain是一款为大规模深度学习模型设计的分布式训练工具。它能够支持训练包含数十亿参数的模型,并保持代码简洁性。该工具集成了ZeRO优化和通信优化等技术,可提高训练效率和显存利用率。BMTrain与PyTorch兼容,仅需少量代码调整即可实现分布式训练。在13B参数的GPT-2模型训练中,BMTrain展现出优越性能。
instruct-eval - 指令调优的大型语言模型的评估和比较
AlpacaFlan-T5GithubIMPACTInstructEvalLLM开源项目
InstructEval项目专注于全面评估和比较指令调优的大型语言模型(如Flan-T5和Alpaca),并提供简便的基准测试库和排行榜。该项目支持多种模型和任务,使研究者能够轻松直观地在学术基准(如MMLU和BBH)上比较模型表现。此外,InstructEval发布了用于评估LLM写作能力的IMPACT数据集和安全评估基准Red-Eval,为用户提供多样的测试工具和资源。
tevatron - 神经检索模型训练与推理工具
GithubHuggingFaceLLM神经检索模型LoRA微调Mistral-7BTevatron开源项目
Tevatron提供高效工具包,支持在GPU和TPU上大规模训练和推理神经检索模型,集成DeepSpeed和LoRA等技术,可加载HuggingFace的预训练模型,适用于神经检索和开放域QA任务。
NeMo - 人工智能训练和部署平台
GithubNVIDIA NeMo多模态模型大语言模型开源项目热门生成式AI语音识别
NeMo框架是NVIDIA开发的一款云原生生成式AI框架,专为研究人员和使用PyTorch的开发者设计,支持大型语言模型、多模态模型、自动语音识别等多个领域。该框架能够利用现有代码和预训练的模型检查点,帮助用户高效创建和定制新的生成式AI模型。通过广泛的教程和文档,用户可以轻松开始使用NeMo框架,无论是在任何云端还是本地环境中。
deap - 灵活高效的进化计算框架,实现快速原型开发和创意测试
DEAPGithubPython库优化算法开源项目进化计算遗传算法
DEAP是一个开源的进化计算框架,为快速原型设计和算法测试提供了便利。它支持多种进化算法,如遗传算法、遗传编程和进化策略,并能处理多目标优化问题。DEAP的核心优势在于其清晰的算法结构和透明的数据结构,同时与并行计算机制兼容性良好。框架内置了多种实用功能,包括精英保存机制、中间结果保存和标准测试函数集等,可应用于解决各类复杂优化问题。
pytorch-lightning - 深度学习框架的全方位AI模型训练与部署解决方案
AI模型训练GithubLightning FabricPyTorch Lightning开源项目模型部署深度学习热门
深度学习框架Pytorch-Lightning 2.0版本现已推出,提供清晰稳定的API,支持AI模型的预训练、微调和部署。该框架轻松实现Pytorch代码组织,将科学研究与工程实现分离,帮助研究人员和工程师高效进行模型训练与部署。通过提供各种训练和部署选项以及兼容多种硬件和加速器,Pytorch-Lightning兼顾模型的灵活性和可扩展性,适应从初学者到专业AI研究的不同需求。
Firefly - 开源大模型训练平台
FireflyGithubQLoRA大模型训练开源项目指令微调预训练
Firefly作为一个开源大模型训练工具,提供预训练、指令微调和DPO的全面解决方案。支持LoRA、QLoRA等高效训练技术,并涵盖多种主流大模型如Qwen2、Yi-1.5,特别适合显存和资源有限的环境。项目不仅开源多种数据集,还在Open LLM排行榜中展示了QLoRA训练的高效性,并与Unsloth合作,进一步优化了训练效率和显存使用。
Meta-Llama-3.1-8B-Instruct - 创新技术实现大型语言模型微调的高效优化
GithubHuggingfaceLlama 3.1Unsloth内存优化开源项目性能提升模型模型微调
该项目开发了一种高效方法,大幅提升Llama 3.1、Gemma 2和Mistral等大型语言模型的微调效率。通过提供多个免费的Google Colab笔记本,项目使各类用户都能便捷地微调Llama-3 8B、Gemma 7B和Mistral 7B等模型。这些笔记本界面友好,适合各层次用户使用。采用此方法可将微调速度提升2-5倍,同时将内存使用降低最多70%,显著优化了资源利用。
effort - LLM模型计算量实时优化的开源实现
GithubLLM模型推理bucketMul算法开源项目权重加载矩阵乘法计算效率优化
Effort是bucketMul算法的开源实现,支持实时调整LLM模型推理过程中的计算量。在Apple Silicon芯片上,50%effort可匹配常规矩阵乘法速度,25%effort则提供双倍速度,同时保持大部分输出质量。项目支持跳过加载次要权重,实现性能与质量的灵活平衡。Effort Engine提供预编译二进制文件,源代码基于Swift和Metal开发。
evalplus - 提升大语言模型代码生成评估的框架
EvalPlusGithubHumanEval+LLM评估MBPP+代码生成开源项目
EvalPlus是一个开源框架,旨在严格评估大语言模型的代码生成能力。它包含HumanEval+和MBPP+两个增强数据集,测试用例数量大幅提升。该框架提供精确评估、代码严谨性检验、LLM生成样本等功能,可显著加速相关研究。EvalPlus支持代码生成、后处理和评估全流程,在GitHub开源并提供Docker镜像,便于研究人员使用。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号