Project Icon

gemma2-9B-daybreak-v0.5-i1-GGUF

多规格IQ量化文件优化AI模型表现

本项目提供多种规格的量化文件,供满足不同AI性能和质量需求的应用选择。用户可通过TheBloke的指南熟悉GGUF文件的使用和多部分合并,并根据具体要求选择合适的文件版本。量化文件包括从i1-IQ1到i1-Q6的不同规格,其中部分文件在优化速度的同时,保持了优秀的质量。感谢nethype GmbH和@nicoboss的技术支持,确保了高质量imatrix量化文件的生产。

codegemma-1.1-7b-it-GGUF - 文本生成的多样化量化模型选择
GithubHugging FaceHuggingfacetransformers开源项目文本生成模型模型下载量化
项目使用llama.cpp进行模型量化,提供多种模型版本以优化文本生成性能。用户可以依据硬件配置选择合适的模型版本,推荐选用Q6_K等高质量量化格式。多样化的模型版本在内存占用和性能表现之间提供灵活选择,适用于多种硬件平台。I-quant模型在较低量化级别上表现优异,适合需要高效运行的场景。
MythoMax-L2-Kimiko-v2-13B-GGUF - 了解多种量化选项和GGUF格式特色
GGUFGPU加速GithubHuggingfaceMythoMax L2 Kimiko v2 13B开源项目格式兼容性模型模型量化
此项目提供MythoMax L2 Kimiko v2 13B模型在GGUF格式中的多种量化文件,优化了标记化及特殊标记支持。用户可选择适用于GPU和CPU推理的版本,并通过llama.cpp、text-generation-webui等多种客户端和库获得支持,兼具兼容性与灵活性,适合不同硬件平台的需求。
huihui-ai_-_Qwen2.5-14B-Instruct-abliterated-v2-gguf - Qwen2.5-14B模型无审查量化版本集合
GithubHuggingfaceQwen2.5-14B大语言模型开源项目权重文件模型模型部署量化模型
这是一个基于Qwen2.5-14B-Instruct模型的GGUF量化版本集合。模型采用abliteration技术移除了安全过滤限制,并提供从5.37GB到14.62GB的多种量化版本,包括Q2_K、IQ3、Q4等系列。项目基于Apache-2.0许可证开源,支持通过transformers库加载使用。
OpenHermes-2.5-Mistral-7B-GGUF - 高效推理的新型模型文件格式
GithubHuggingfaceOpenHermes-2.5-Mistral-7B下载指南开源项目模型模型兼容性量化量化方法
GGUF是一种由llama.cpp团队于2023年8月引入的新型模型文件格式,旨在取代GGML,不再受其支持。该格式兼容众多第三方用户界面及库,例如llama.cpp、text-generation-webui和KoboldCpp等平台,这些平台支持GPU加速,从而提高文本生成任务的效率。Teknium的OpenHermes 2.5 Mistral 7B模型在此格式下得以量化处理,通过多种量化方法平衡模型文件大小与推理质量,适用于包括CPU+GPU推理在内的多种场景。用户在多种设备和平台上使用该格式能获取所需模型,并通过Massed Compute的硬件支持获得性能优化。
Llama-3-Smaug-8B-GGUF - Llama-3-Smaug-8B模型的GGUF格式文件 支持多级量化
GGUF模型GithubHuggingfaceLlama-3-Smaug-8B人工智能助手开源项目文本生成模型量化
Llama-3-Smaug-8B-GGUF项目提供abacusai/Llama-3-Smaug-8B模型的GGUF格式文件,支持2-bit至8-bit多级量化。项目介绍了使用llama.cpp加载模型的方法,并概述了GGUF格式及其兼容工具。该资源有助于用户了解GGUF格式,选择适合的工具进行本地部署和文本生成应用。
Replete-LLM-V2.5-Qwen-32b-GGUF - 量化模型文件下载指南,通过选择适合的文件优化性能
GithubHuggingfaceReplete-LLM-V2.5-Qwen-32b嵌入输出权重开源项目文本生成模型视觉处理量化
该项目使用llama.cpp工具进行模型量化,提供多种Replete-LLM-V2.5-Qwen-32b模型文件下载选项。每种文件类型均说明其特性,如高质量和性能等,并适应不同硬件环境,以帮助用户根据需求优化模型质量或速度。文件适用于多种RAM和VRAM配置,便于在不同系统中实现优异性能。
aya-23-8B-GGUF - 更精细的文本生成量化选项分析
GithubHuggingfacetransformers开源项目文本生成模型质心量化
项目使用最先进的llama.cpp imatrix量化技术,支持多语言文本生成。多种量化格式,例如Q8_0和紧凑型IQ系列,提供应用的灵活性。用户依据硬件选择文件,以优化性能。创新量化处理为多语言文本生成提供了更高效的实现路径。
Qwen2-1.5B-Instruct-GGUF - Qwen2-1.5B指令模型的GGUF格式压缩版本
GGUFGithubHuggingfaceQwen人工智能开源项目模型语言模型量化模型
本项目提供Qwen2-1.5B-Instruct模型的GGUF格式文件,包含多种量化级别。GGUF是llama.cpp团队开发的新格式,取代了旧有的GGML。这些文件兼容多个支持GGUF的平台,如llama.cpp和LM Studio,便于高效本地部署和推理。项目提供多种选择,可适应不同性能和资源需求。
Mistral-7B-Instruct-v0.1-GGUF - Mistral 7B Instruct模型的GGUF量化版本
AI模型GGUFGithubHuggingfaceMistral 7B开源项目模型自然语言处理量化
本项目提供Mistral 7B Instruct v0.1模型的GGUF格式量化版本。GGUF是llama.cpp团队推出的新格式,替代了GGML。项目包含2至8比特多种量化模型文件,支持CPU和GPU高效推理,适用于llama.cpp、text-generation-webui等多种客户端和库。此外还提供兼容性说明、文件说明和使用指南。
Tiny-Vicuna-1B-GGUF - 量化的Tiny Vicuna 1B GGUF模型文件优化文本生成效率
GithubHuggingfaceTiny-Vicuna-1B开源项目文件文本生成模型量化
此项目提供了afrideva量化的Tiny Vicuna 1B GGUF模型文件,涵盖q2_k、q3_k_m、q4_k_m、q5_k_m、q6_k和q8_0等量化方法,文件大小从482.14 MB到1.17 GB不等。模型由Jiayi-Pan在TinyLLama 1.1B基础上创建,利用WizardVicuna数据集进行微调,适合早期的实验迭代。模型旨在提升文本生成任务的效率,具备高效性能和简便操作,适合紧凑存储需求的应用。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能,包括文生视频、动态画面和形象生成等,帮助用户快速上手,创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台,用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品,帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型,为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能,满足事务性工作的高频需求,帮助撰稿人节省精力,提高效率,优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号