Project Icon

PINTO_model_zoo

提供多框架神经网络模型转换与量化的开源工具

PINTO_model_zoo 是一个开源工具库,支持 TensorFlow、PyTorch、ONNX、OpenVINO 等多个框架的模型转换和量化。项目提供多种量化方法,包括权重量化、整数量化和浮点数量化,旨在优化模型性能以适应不同平台,如 RaspberryPi 和 EdgeTPU。它还提供大量预量化模型和详细转换指南,帮助开发者在各种设备上高效部署深度学习模型。

EVA-Qwen2.5-14B-v0.1-GGUF - 多格式量化模型文件下载,便捷获取高性能AI模型
EVA-Qwen2.5-14B-v0.1GithubHugging FaceHuggingface开源项目权重矩阵模型语料库量化方法
EVA-Qwen2.5-14B-v0.1-GGUF提供多种量化模型文件支持AI模型部署,涵盖Q2_K至Q8_0格式。通过Hugging Face和nethype GmbH的资源,项目提供了性能优异的模型文件。详细使用方法请参考项目链接中的文档,FAQ部分提供了常见问题的解答。
hummingbird - 用于将经过训练的传统 ML 模型编译为张量计算的库
GithubHummingbirdPyTorch加速推理开源项目机器学习模型神经网络
Hummingbird通过将训练好的传统机器学习模型编译为张量计算,使其能够借助神经网络框架(如PyTorch)加速。用户可利用神经网络框架的优化和硬件加速,无需重新设计模型。支持多种模型如决策树、随机森林、LightGBM和XGBoost,并提供易于替换的推理API。支持转换为PyTorch、TorchScript、ONNX和TVM格式。
Mistral-Nemo-Instruct-2407-FP8 - FP8量化技术在模型优化与部署中的应用
GithubHuggingfaceMistral-Nemo-Instruct-2407-FP8开源项目模型模型优化评估部署量化
Mistral-Nemo-Instruct-2407-FP8通过FP8量化技术提升了模型的内存和体积效率,主要用于商业和研究。该模型适用于英语聊天助手,利用参数位数的减少节省约50%的资源。结合vLLM>=0.5.0的高效推理环境,优化部署性能。量化由AutoFP8完成,Neural Magic计划转向支持更多方案的llm-compressor。尽管量化后某些评测得分略有下降,但保持的性能恢复率使其成为资源效率化的优选方案。
OnnxStream - 适用于低资源设备的模型运行的内存优化的推理库
GithubMistral 7BOnnxStreamStable Diffusion XLTinyLlama开源项目性能
OnnxStream专为优化内存使用而设计,支持在低资源设备上高效运行大型模型如Stable Diffusion和TinyLlama。在仅有512MB RAM的Raspberry Pi Zero 2上,实现图像生成和语言模型推理,而无需额外交换空间或磁盘写入。通过解耦推理引擎与模型权重组件,OnnxStream显著降低内存消耗,提供轻量且高效的推理解决方案。其静态量化和注意力切片技术增强了多种应用中的适应性和性能。
torch2trt - PyTorch模型转TensorRT加速工具
GPU加速GithubPyTorchTensorRTtorch2trt开源项目模型转换
torch2trt是一款将PyTorch模型转换为TensorRT的开源工具。它基于TensorRT Python API开发,具有简单易用和灵活可扩展的特点。用户通过单个函数调用即可完成模型转换,还支持自定义层转换器。该工具适配多种常用模型,并提供模型保存和加载功能。torch2trt能显著提升NVIDIA设备上的模型推理性能,适用于PyTorch模型推理加速场景。
Phi-3-mini-4k-instruct - 高效节省内存的模型微调策略,快速实现量化优化
GithubHuggingfacePhi-3免费微调内存优化开源项目机器学习模型量化模型
此项目通过Unsloth量化技术,提供高效的Mistral平台大模型微调方案,速度提升至2-5倍,内存占用降低至50-70%。提供的Colab笔记本支持Phi-3、Llama 3、Gemma 2等多种模型,简单易用,适合初学者。用户可以节省计算资源,并将微调后的模型导出至GGUF或上传至Hugging Face,方便成果共享。
CTranslate2 - 高效的Transformer模型推理库,提供多种性能优化方案
CTranslate2Github并行执行开源项目性能优化模型压缩转换器模型
CTranslate2是一个用于Transformer模型高效推理的C++和Python库,通过权重量化、层融合、批次重排序等技术,显著提升CPU和GPU上的执行速度并减少内存占用。支持多种模型类型,包括编码器-解码器、仅解码器和仅编码器模型,兼容OpenNMT-py、OpenNMT-tf、Fairseq等框架。其主要特点包括自动CPU检测、代码分发、并行和异步执行以及动态内存使用。
onnx-web - 简化ONNX模型运行的跨平台工具
AI绘图GithubStable Diffusiononnx-web图像生成开源项目硬件加速
onnx-web是一个简化ONNX模型运行过程的开源工具,支持AMD和Nvidia GPU加速以及CPU回退。它提供用户友好的Web界面,支持txt2img、img2img等多种diffusion管道。该工具允许添加自定义模型,融合LoRA等附加网络,并具有多阶段和区域提示功能。onnx-web还提供API接口,适用于各种创作需求。
tf-quant-finance - 基于TensorFlow的高性能量化金融库,支持多层数学和定价模型
GithubPythonTF Quant FinanceTensorFlow定价模型开源项目数学方法
TF Quant Finance利用TensorFlow的硬件加速和自动微分,提供从基础数学算法到高级定价模型的功能,包括优化、插值、微分方程求解和金融模型校准。库的功能正在不断扩展,并提供独立可运行的示例,便于用户学习和应用。
Llama-3-8B-Instruct-GPTQ-4-Bit - 利用GPTQ量化优化模型性能的新方法
Apache AirflowGPTQGithubHuggingfaceMeta-Llama-3-8B-Instruct开源项目数据协调模型量化
Astronomer的4比特量化模型通过GPTQ技术减少VRAM占用至不足6GB,比原始模型节省近10GB。此优化提高了延迟和吞吐量,即便在较便宜的Nvidia T4、K80或RTX 4070 GPU上也能实现高效性能。量化过程基于AutoGPTQ,并按照最佳实践进行,使用wikitext数据集以减小精度损失。此外,针对vLLM和oobabooga平台提供详细配置指南,以有效解决加载问题。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号