Project Icon

Phi-3.5-mini-instruct_Uncensored-GGUF

优化的量化模型提供多种压缩方案支持不同运行环境

该项目基于llama.cpp框架,将Phi-3.5-mini-instruct模型转换为GGUF格式,提供从F16到IQ2_M共19种量化版本。模型文件大小范围在1.32GB至7.64GB之间,适配CPU和GPU环境。Q6_K、Q5_K系列及IQ4_XS等版本在性能与体积上表现均衡,可根据硬件配置选择适合的版本使用。

Open_Gpt4_8x7B_v0.2-GGUF - 提供多格式兼容量化模型,提升推理效率
GGUFGithubHuggingfaceOpen Gpt4 8X7B V0.2rombo dawg开源项目模型模型兼容性量化
此项目提供GGUF格式的多精度量化模型文件,旨在优化CPU和GPU的推理效率。作为GGML的替代,GGUF与多种第三方UI和库兼容,支持多平台AI模型的高效运行。项目包含2至8位量化模型以满足不同精度与内存要求,适合多种场景需求。通过详细的下载指导,用户能快速找到适合的模型文件,并利用llama.cpp、text-generation-webui等高性能运行时实现模型在不同硬件上的高效推理。
llama3-8B-DarkIdol-2.2-Uncensored-1048K-GGUF - 多语言支持的llama3-8B GGUF量化模型,提供多级压缩优化
GGUFGithubHuggingfacellama3大语言模型开源项目权重压缩模型量化模型
llama3-8B GGUF量化模型支持英语、日语和中文,提供3.3GB至16.2GB多种压缩版本,适应不同硬件需求。Q4_K系列在性能和质量上表现均衡。模型基于transformers库开发,适用于角色扮演和偶像相关场景。用户可通过Hugging Face平台获取各版本及其性能对比信息。
Llama-3-Smaug-8B-GGUF - Llama-3-Smaug-8B模型的GGUF格式文件 支持多级量化
GGUF模型GithubHuggingfaceLlama-3-Smaug-8B人工智能助手开源项目文本生成模型量化
Llama-3-Smaug-8B-GGUF项目提供abacusai/Llama-3-Smaug-8B模型的GGUF格式文件,支持2-bit至8-bit多级量化。项目介绍了使用llama.cpp加载模型的方法,并概述了GGUF格式及其兼容工具。该资源有助于用户了解GGUF格式,选择适合的工具进行本地部署和文本生成应用。
Llama-3.2-3B-Instruct-GGUF - 量化版Llama 3.2 3B指令模型的GGUF格式实现
GGUFGithubHuggingfaceLlama大语言模型开源项目文本生成模型量化模型
本项目提供Llama-3.2-3B-Instruct模型的GGUF格式文件。GGUF是llama.cpp团队推出的新格式,取代了旧有的GGML。模型支持2-bit至8-bit多种量化级别,适用于文本生成。项目还介绍了多个支持GGUF的工具和库,如llama.cpp、LM Studio等,方便用户选择合适的使用方式。
Rombos-LLM-V2.6-Qwen-14b-GGUF - 基于llama.cpp的Qwen-14B量化模型集合
GGUFGithubHuggingfaceRombos-LLMllama.cpp开源项目模型模型压缩量化
llama.cpp量化的Qwen-14B开源项目,通过imatrix方案优化生成多种GGUF格式模型文件。模型尺寸从2GB到29GB不等,覆盖Q2至F16多种量化精度,并针对不同硬件架构进行优化。项目提供完整的模型选择指南,方便本地部署时根据实际硬件环境选择合适版本。
Llama-3-8B-Instruct-32k-v0.1-GGUF - Llama-3 8B指令模型GGUF版本支持多位量化及广泛应用
GGUFGithubHuggingfaceLlama-3开源AI开源项目模型自然语言处理量化模型
本项目提供Llama-3-8B-Instruct-32k-v0.1模型的GGUF格式文件。GGUF是llama.cpp团队开发的新格式,取代了旧有的GGML。该模型支持2至8位量化,主要用于文本生成。它与多款主流本地运行框架和界面工具兼容,如llama.cpp、LM Studio和text-generation-webui等。这些工具普遍支持GPU加速,使模型能够适应多样化的应用需求。
Qwen2-1.5B-Instruct-GGUF - Qwen2-1.5B指令模型的GGUF格式压缩版本
GGUFGithubHuggingfaceQwen人工智能开源项目模型语言模型量化模型
本项目提供Qwen2-1.5B-Instruct模型的GGUF格式文件,包含多种量化级别。GGUF是llama.cpp团队开发的新格式,取代了旧有的GGML。这些文件兼容多个支持GGUF的平台,如llama.cpp和LM Studio,便于高效本地部署和推理。项目提供多种选择,可适应不同性能和资源需求。
codegemma-7b-GGUF - 经过量化优化的代码生成模型,支持多种精度选择的GGUF格式
CodeGemmaGGUFGithubHuggingface开源项目性能对比文件大小模型模型量化
这个项目提供了CodeGemma-7b模型的多种量化版本,文件大小从2.16GB到9.07GB不等,采用GGUF格式。支持从Q8到IQ1的多种精度等级,可适应不同的硬件配置。其中Q6_K、Q5_K和Q4_K系列版本在性能和空间优化方面表现较好,适合生产环境使用。用户可根据自身的内存和显存情况选择合适的版本。
Llama-3-8B-Instruct-v0.9-GGUF - 高效量化Llama-3-8B-Instruct模型支持多种位宽
GGUFGithubHuggingfaceLlama-3人工智能开源项目文本生成模型量化模型
Llama-3-8B-Instruct-v0.9模型的GGUF格式量化版本提供2-bit至8-bit多种位宽选择。GGUF作为llama.cpp团队推出的新格式取代了GGML。该模型兼容多种GGUF支持的客户端和库,如llama.cpp和LM Studio,支持GPU加速,适合本地部署文本生成任务。
guanaco-65B-GGUF - 解析新型GGUF格式及其多平台兼容性
GPU加速GithubGuanaco 65BHuggingfaceTim Dettmers开源项目模型模型格式量化
此项目涵盖了2023年8月21日由llama.cpp团队推出的GGUF格式,作为已停用的GGML格式的替代方案。该项目提供了多种比特的量化文件,适用于CPU和GPU的推理需求。用户能够通过多种客户端和库,如llama.cpp和text-generation-webui,下载并高效使用这些模型,提供本地及网络接口支持。所支持的量化方法包括GGML_TYPE_Q4_K,提供质量与性能的平衡。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能,包括文生视频、动态画面和形象生成等,帮助用户快速上手,创造专业级内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台,用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品,帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型,为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能,满足事务性工作的高频需求,帮助撰稿人节省精力,提高效率,优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号