Project Icon

NemoMix-Unleashed-12B-GGUF

NemoMix-Unleashed-12B模型的多种量化版本

NemoMix-Unleashed-12B-GGUF项目提供了多种NemoMix-Unleashed-12B模型的量化版本。这些版本采用llama.cpp进行处理,精度范围从F16到IQ2_M,文件大小在4.44GB至24.50GB之间。项目详细介绍了各量化类型、文件大小及使用建议,便于用户根据硬件选择合适版本。同时提供下载指南和性能比较资料,方便模型部署和评估。

Llama-3-Smaug-8B-GGUF - Llama-3-Smaug-8B模型的GGUF格式文件 支持多级量化
GGUF模型GithubHuggingfaceLlama-3-Smaug-8B人工智能助手开源项目文本生成模型量化
Llama-3-Smaug-8B-GGUF项目提供abacusai/Llama-3-Smaug-8B模型的GGUF格式文件,支持2-bit至8-bit多级量化。项目介绍了使用llama.cpp加载模型的方法,并概述了GGUF格式及其兼容工具。该资源有助于用户了解GGUF格式,选择适合的工具进行本地部署和文本生成应用。
Qwen2.5-Math-7B-Instruct-GGUF - 针对性能和空间优化的Qwen2.5数学模型GGUF量化版本
GGUFGithubHuggingfaceQwen2.5-Math-7B-Instruct大语言模型开源项目模型模型压缩量化
Qwen2.5-Math-7B-Instruct模型的GGUF量化版本集合,文件大小从2.78GB到15GB不等。采用K-quant和I-quant量化技术,适配主流GPU平台。Q6_K和Q5_K系列在模型性能和资源占用上取得较好平衡,可通过LM Studio实现便捷部署。
Llama-3-8B-Instruct-DPO-v0.2-GGUF - Llama-3-8B的GGUF格式量化模型
GGUFGithubHuggingfaceLlama-3大型语言模型开源项目文本生成模型量化
Llama-3-8B-Instruct-DPO-v0.2模型的GGUF格式量化版本,提供2-bit至8-bit多级量化选项。该版本显著减小模型体积和内存需求,同时维持性能。采用ChatML提示模板,兼容多种GGUF格式支持工具,如llama.cpp和LM Studio。此轻量化版本使大型语言模型能在更多设备上本地运行,扩展了应用范围。
Replete-LLM-V2.5-Qwen-7b-GGUF - Qwen-7b模型GGUF量化版本集合 适配多种硬件配置
GGUFGithubHuggingfaceQwen开源项目显存优化机器学习模型量化模型
Replete-LLM-V2.5-Qwen-7b-GGUF是经LLAMA.cpp量化处理的Qwen-7b模型系列,提供24种不同量化版本。从15.24GB的F16到2.78GB的IQ2_M,涵盖多种规格以适应不同硬件。支持CPU和GPU部署,并为ARM架构优化。采用imatrix量化方案,附有详细性能说明,便于选择合适版本。
guanaco-33B-GGUF - Guanaco 33B模型的高效量化格式,支持多平台部署
GPU加速GithubGuanaco 33BHuggingfaceTim Dettmers开源项目模型模型格式量化
该项目提供的GGUF格式量化模型文件针对Guanaco 33B进行了优化,适用于多种平台,包括llama.cpp和text-generation-webui。作为GGML的替代格式,GGUF引入了改良的量化方法,支持2到8位的量化,满足各种硬件资源需求。其优势在于提高AI推理性能与效率,并支持GPU加速,适合对AI生成及推理质量有较高要求的应用场景。
Luna-AI-Llama2-Uncensored-GGUF - 开源Llama 2模型的GGUF量化版本
GGUFGithubHuggingfaceLlama人工智能开源项目文件格式模型量化压缩
这是Tap-M开发的Luna AI Llama2 Uncensored模型的GGUF量化版本。项目提供了2-8比特不同量化级别的模型文件,支持CPU和GPU推理,可与llama.cpp及主流UI框架配合使用。模型基于cc-by-sa-4.0和Meta Llama 2双重许可协议发布。
MN-12B-Starcannon-v3-i1-GGUF - 多种量化选项提升模型性能和适应性
GithubHugging FaceHuggingfaceMN-12B-Starcannon-v3transformers开源项目模型量化模型静态量化
该项目提供多种量化文件类型和大小,满足不同用户需求,优化模型性能。用户可在mradermacher的Hugging Face页面获取IQ-quants与静态量化文件。有关GGUF文件的使用,建议查阅TheBloke的说明。本项目通过iMatrix文件,专注于高质量模型的量化,感谢nethype GmbH及nicoboss的硬件支持。
gemma-2-27b-it-GGUF - Gemma-2-27b-it模型的多精度GGUF量化版本
GemmaGithubHuggingfaceLlamaEdge大语言模型开源项目推理服务模型模型量化
Gemma-2-27b-it模型的GGUF量化版本提供2至16比特的多种精度选项。基于LlamaEdge框架,支持8192上下文窗口,可通过WasmEdge以服务或命令行方式运行。Q4_K_M和Q5_K_M版本在模型大小和性能间取得平衡,适合多数应用场景。
Mistral-7B-Instruct-v0.1-GGUF - Mistral 7B Instruct模型的GGUF量化版本
AI模型GGUFGithubHuggingfaceMistral 7B开源项目模型自然语言处理量化
本项目提供Mistral 7B Instruct v0.1模型的GGUF格式量化版本。GGUF是llama.cpp团队推出的新格式,替代了GGML。项目包含2至8比特多种量化模型文件,支持CPU和GPU高效推理,适用于llama.cpp、text-generation-webui等多种客户端和库。此外还提供兼容性说明、文件说明和使用指南。
Meta-Llama-3.1-8B-Instruct-GGUF - 多语言大型语言模型的量化GGUF版本
GithubHuggingfaceLlama 3多语言大语言模型开源项目指令调优模型量化
Meta Llama 3.1 8B Instruct模型的GGUF量化版本是一个多语言大型语言模型,经过指令调优,适用于多语言对话场景。该项目提供多种量化版本,从Q2_K到f16不等,文件大小范围为3.18GB至16.07GB,可满足不同硬件配置需求。这些量化版本使得模型能够在各种计算资源条件下运行,提高了模型的可访问性和实用性。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号