#模型压缩

FasterAI：基于FastAI和PyTorch的神经网络压缩与加速库

2 个月前

神经网络模型压缩稀疏化剪枝 Fasterai Github 开源项目

2 个月前

知识蒸馏技术综述:从理论到实践

2 个月前

知识蒸馏深度学习模型压缩神经网络 AI Github 开源项目

2 个月前

BK-SDM: 轻量高效的下一代文本生成图像模型

2 个月前

Stable Diffusion AI绘图模型压缩知识蒸馏图像生成 Github 开源项目

2 个月前

Awesome Efficient AIGC: 提升人工智能生成内容效率的前沿技术综述

2 个月前

AIGC LLM 量化高效推理模型压缩 Github 开源项目

2 个月前

Distil-Whisper:更快更轻的语音识别模型

2 个月前

Distil-Whisper 语音识别模型压缩自然语言处理机器学习 Github 开源项目

2 个月前

SparseGPT:一次性准确剪枝大规模语言模型的创新技术

2 个月前

SparseGPT 语言模型模型压缩稀疏化神经网络剪枝 Github 开源项目

2 个月前

大型语言模型(LLM)阅读清单:一份全面的入门指南

2 个月前

LLM Transformer 模型压缩深度学习自然语言处理 Github 开源项目

2 个月前

BitNet: 用1比特变换器缩放大型语言模型

2 个月前

BitNet 1比特变换器大语言模型 PyTorch实现模型压缩 Github 开源项目

2 个月前

Knowledge Distillation Toolkit: 压缩机器学习模型的强大工具

2 个月前

知识蒸馏模型压缩 PyTorch 学生模型教师模型 Github 开源项目

2 个月前

GAN压缩:实现高效的交互式条件生成对抗网络

2 个月前

GAN Compression 图像生成模型压缩条件生成对抗网络性能优化 Github 开源项目

2 个月前

相关项目

airllm

AirLLM优化了推理内存使用，使70B大模型能在单个4GB GPU上运行，无需量化、蒸馏或剪枝。同时，8GB显存可运行405B的Llama3.1。支持多种模型压缩方式，推理速度可提升至3倍。兼容多种大模型，提供详细配置和案例，支持在MacOS上运行。

DeepSpeed

DeepSpeed 是一个深度学习优化软件套件，专为大规模模型训练和推理设计，能显著优化系统性能和降低成本。它支持亿级至万亿级参数的高效管理，兼容各种计算环境，从资源受限的GPU系统到庞大的GPU集群。此外，DeepSpeed 在模型压缩和推理领域亦取得创新成就，提供极低的延迟和极高的处理速率。

nni

NNI提供一站式解决方案，支持自动化的特征工程、神经架构搜索、超参数调整和模型压缩。它兼容多种框架，并提供详尽的API、丰富的示例及全面的教程。适用于多种训练环境，包括本地、远程SSH服务器和Kubernetes，帮助推动开源社区的技术发展。

SqueezeLLM

SqueezeLLM通过密集与稀疏量化方法降低大语言模型的内存占用并提升性能，将权重矩阵拆分为易量化的密集组件和保留关键部分的稀疏组件，实现更小内存占用、相同延迟和更高精度。支持包括LLaMA、Vicuna和XGen在内的多个热门模型，提供3位和4位量化选项，适用于不同稀疏度水平。最新更新涵盖Mistral模型支持和自定义模型量化代码发布。

AliceMind

此项目涵盖了阿里巴巴机器智能实验室（MinD Lab）开发的多种预训练模型和优化技术。包括首个提升多模态大语言模型mPLUG-Owl2和多模态文档理解模型mPLUG-DocOwl。另有中文视频语言预训练数据集Youku-mPLUG和多模态语言模型mPLUG-Owl的新型训练范式。此外，还包含开放域对话系统ChatPLUG、跨文本、图像和视频的多模态基础模型mPLUG-2等，适用于语言理解、生成、表格理解和跨语言等应用场景。

PaddleSlim

PaddleSlim是一个深度学习模型压缩的工具库，提供低比特量化、知识蒸馏、稀疏化和模型结构搜索等策略。支持自动化压缩，量化预测能加速2.5倍，模型体积减少3.9倍。提供YOLOv8自动化压缩示例，并优化了在Nvidia GPU和ARM设备上的性能。适用于视觉和自然语言处理任务。支持PaddlePaddle和PaddleLite多个版本，适合有模型压缩需求的开发者使用。

onnx-tool

ONNX-tool是一款强大的工具，支持ONNX模型的解析和编辑、推断和压缩。适用于自然语言处理和计算机视觉模型，提供模型构建、形状推断、激活压缩、权重压缩及计算图优化，以提升推理性能和存储效率。

distill-sd

基于知识蒸馏技术开发的小型高速Stable Diffusion模型。这些模型保留了完整版本的图像质量，同时大幅减小了体积和提升了速度。文档详细介绍了数据下载脚本、U-net训练方法和模型参数设置，还支持LoRA训练及从检查点恢复。提供清晰的使用指南和预训练模型，适配快速高效图像生成需求。

DeepSpeed

DeepSpeed是一个先进的深度学习优化工具库，专门设计用于简化和增强分布式训练。通过一系列创新技术，如ZeRO、3D并行处理、MoE和ZeRO-Infinity，DeepSpeed能大幅提高训练速度，同时降低成本。这些技术支持在数千GPU上扩展模型训练，并实现低延迟和高吞吐量的推理性能。DeepSpeed同时提供了先进的模型压缩技术，优化模型存储与推理效率，是大规模AI模型训练和推理的优选方案。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com