Project Icon

lightning-thunder

PyTorch模型优化编译器 显著提升训练速度

Lightning Thunder是一款专为PyTorch设计的源到源编译器。它通过整合nvFuser、torch.compile、cuDNN等多种硬件执行器,大幅提升PyTorch程序的执行效率。支持单GPU和多GPU环境,在Llama 2 7B模型训练中实现40%的吞吐量提升。Thunder具有易用性、可理解性和可扩展性,是PyTorch开发者提升模型性能的有力工具。

FLASH-pytorch - FLASH 线性时间内提升Transformer效能的开源实现
FLASHGithubPyTorchTransformer开源项目注意力机制深度学习
FLASH-pytorch是一个开源项目,实现了一种高效的Transformer变体。该项目采用门控注意力单元(GAU)和分组线性注意力,在线性时间内提升模型性能。它提供简洁API,支持自回归和非自回归模式,并整合多种位置编码技术。这一工具使研究人员和开发者能够便捷地探索和应用Transformer的最新优化技术。
lightseq - 基于CUDA的高性能训练与推理库
BERT性能GithubLightSeqTransformer模型序列处理开源项目混合精度训练
LightSeq为基于CUDA的高性能训练与推理库,专为序列处理和生成优化,支持BERT、Transformer等主流模型。最新版本新增int8混合精度功能,显著提升训练与推理效率,完美兼容Fairseq、Hugging Face等框架。
WizardCoder-Python-34B-V1.0-llamafile - 指南:如何利用llamafile格式高效运行AI模型
GithubHuggingfaceMozilla OchoWizardCoder Python 34B V1.0开源项目文本生成模型模型库量化
了解llamafile格式如何提升AI模型在多平台的运行效率,支持多种量化配置以实现不同设备的加速运算。
TensorRT-LLM - NVIDIA开发的大型语言模型推理优化工具
AI推理GPU加速GithubNVIDIATensorRT-LLM大语言模型开源项目
TensorRT-LLM是一个用于优化大型语言模型推理的开源工具。它提供Python API来定义模型和构建TensorRT引擎,支持多GPU和多节点部署。该工具集成了多种量化技术,如INT4/INT8权重量化和SmoothQuant,以提升性能和降低内存占用。TensorRT-LLM预置了多个常用模型,可根据需求进行修改和扩展。
triton - 开源高效深度学习原语编程语言与编译器
GPU编程GithubLLVMTriton开源项目深度学习编译器
Triton是一种开源编程语言和编译器,专为编写高效的自定义深度学习原语而设计。它提供了一个兼具高生产力和灵活性的开发环境,性能优于CUDA,灵活性超过其他领域特定语言。Triton支持NVIDIA和AMD GPU平台,提供完善的文档和教程。用户可通过pip轻松安装,也支持源代码构建。该项目持续更新,最新版本进行了大量性能优化和问题修复。
Meta-Llama-3.1-70B-Instruct-bnb-4bit - 量化调优技术显著提升性能,减少资源消耗
GithubHuggingfaceLlama 3.1Unsloth免费教程开源项目性能优化模型模型微调
Unsloth工具实现对Llama 3.1等模型的量化,显著减少内存使用,提升运行速度至原来的2-5倍。提供适合初学者的Google Colab免费笔记本,简单加载数据集即可运行得到优化模型,可导出为GGUF、vLLM等格式或上传至Hugging Face。支持多种模型,如Llama-2、Gemma、Mistral,满足高效调优需求。
Llama-3.1-Storm-8B - 多任务智能的高性能开源语言模型
GithubHuggingfaceLlama-3.1-Storm-8B人工智能大语言模型开源项目机器学习模型模型微调
Llama-3.1-Storm-8B是基于Llama-3.1-8B-Instruct改进的开源语言模型。通过自主数据筛选、定向微调和模型合并,它在10个基准测试中显著超越原始模型,包括指令遵循、知识问答、推理能力、真实性和函数调用。GPQA提升7.21%,TruthfulQA提升9%,函数调用准确率提升7.92%。支持Transformers、vLLM和Ollama等多种部署方式,为AI开发者提供高性能的通用型语言模型选择。
tutorials - PyTorch Lightning 教程,轻量级可执行笔记本集
GithubJupyter NotebookPytorchLightning开源项目教程机器学习
这是一个开源的 PyTorch Lightning 教程集合,提供轻量级、可执行和可复现的笔记本。项目涵盖 Lightning 的各种应用,包括最佳实践、数据集使用和开发技巧。内容适合不同水平的开发者,从入门到深入学习都有所涉及。
LLaMA-Factory - 提升语言模型微调效率的统一平台
GithubLLaMA Factory大语言模型开源项目快速微调性能优化模型量化热门
LLaMA-Factory是一个高效的语言模型微调工具,支持多种模型和算法。该平台专注于提高微调速度,支持连续预训练、监督微调和激励建模等策略。LLaMA-Factory利用LoRA技术实现高效训练,并提供详尽的数据监控和快速推理能力。此外,新版本还增加了PiSSA算法,且支持多种开发平台如Colab和DSW,适合高质量文本生成和智能应用开发。
hidet - 用Python编写的开源深度学习编译器,主要优化NVIDIA GPU上的推理任务
CUDAGithubHidetONNXPyTorch开源项目深度学习编译器
Hidet是一个用Python编写的开源深度学习编译器,主要优化NVIDIA GPU上的推理任务。它能将PyTorch和ONNX模型编译成高效的CUDA内核,通过图级和算子级优化提升性能。Hidet易于集成,支持通过torch.compile优化PyTorch模型,为开发者提供了便捷的深度学习性能优化方案。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号