Project Icon

OpenCrystal-15B-L3-v2-i1-GGUF

提供多种量化文件支持AI模型性能提升

OpenCrystal-15B-L3-v2-i1-GGUF项目提供多种GGUF量化文件,旨在优化AI模型的性能。不同的量化类型和大小让用户可以按照需求选择合适的设置,以提升模型运行速度或在资源有限的情况下提高输出质量。感谢nethype GmbH公司和@nicoboss对项目的技术支持。

Replete-LLM-V2.5-Qwen-7b-GGUF - Qwen-7b模型GGUF量化版本集合 适配多种硬件配置
GGUFGithubHuggingfaceQwen开源项目显存优化机器学习模型量化模型
Replete-LLM-V2.5-Qwen-7b-GGUF是经LLAMA.cpp量化处理的Qwen-7b模型系列,提供24种不同量化版本。从15.24GB的F16到2.78GB的IQ2_M,涵盖多种规格以适应不同硬件。支持CPU和GPU部署,并为ARM架构优化。采用imatrix量化方案,附有详细性能说明,便于选择合适版本。
Llama-3.2-1B-Instruct-Uncensored-GGUF - Llama小型无审查语言模型的量化实现
GGUFGithubHuggingfaceLlamatransformers开源项目模型语言模型量化模型
这是针对Llama-3.2-1B-Instruct-Uncensored模型的GGUF量化项目,提供从Q2_K到f16在内的多种量化版本。模型文件大小范围在0.7GB至2.6GB之间,通过不同的量化方案平衡了性能与存储空间。项目包含完整的性能对比数据和使用文档,方便开发者根据实际需求选择合适的模型版本。
Phi-3.5-mini-instruct-GGUF - Microsoft Phi-3.5-mini模型的GGUF格式多位宽量化版本
GGUFGithubHuggingfacePhi-3.5开源项目文本生成本地部署模型量化模型
此项目提供Microsoft Phi-3.5-mini-instruct模型的GGUF格式量化版本。GGUF是llama.cpp团队推出的新格式,取代了GGML。支持2-bit至8-bit多种量化位宽,兼容多个GGUF支持工具,如llama.cpp和LM Studio。这些工具具备GPU加速和Web界面,便于本地部署和使用大型语言模型。
CodeQwen1.5-7B-GGUF - 丰富的量化模型选择,多平台优化性能
CodeQwen1.5-7BGithubHugging FaceHuggingface内存需求开源项目模型模型质量量化
通过llama.cpp工具实现多量化模型的生成,CodeQwen1.5系列提供不同文件大小和质量选项,适用于各种设备资源和性能需求。推荐选择高质量Q6_K和Q5_K_M格式,平衡性能与存储空间。该项目适合RAM和VRAM有限的用户,并支持多种格式在不同硬件平台上运行。新方法如I-quants提高性能输出,但与Vulcan不兼容,适用于Nvidia的cuBLAS和AMD的rocBLAS。丰富的特性矩阵便于深入比较选择。
Qwen2.5-7B-Instruct-Uncensored-GGUF - 中英文无删减指令模型的最新静态量化版本,适合多语言支持
GithubHugging FaceHuggingfaceQwen2.5-7B-Instruct-Uncensored开源项目数据集模型量化
该项目为Qwen2.5-7B-Instruct-Uncensored模型提供多种质量和大小的静态量化文件,支持中英文双语功能。用户可选择合适的量化类型,包括快速的Q4_K_S与Q4_K_M以及高质量的Q8_0和Q6_K。这些文件可提升模型性能,尤其在敏感内容处理及多语言支持方面。使用说明可参考TheBloke的文档。项目得益于nethype公司的资源支持。
Tiny-Vicuna-1B-GGUF - 量化的Tiny Vicuna 1B GGUF模型文件优化文本生成效率
GithubHuggingfaceTiny-Vicuna-1B开源项目文件文本生成模型量化
此项目提供了afrideva量化的Tiny Vicuna 1B GGUF模型文件,涵盖q2_k、q3_k_m、q4_k_m、q5_k_m、q6_k和q8_0等量化方法,文件大小从482.14 MB到1.17 GB不等。模型由Jiayi-Pan在TinyLLama 1.1B基础上创建,利用WizardVicuna数据集进行微调,适合早期的实验迭代。模型旨在提升文本生成任务的效率,具备高效性能和简便操作,适合紧凑存储需求的应用。
BioMistral-7B-GGUF - 精准医学文本生成的多位量化模型
BioMistral-7B-GGUFGPU加速GithubHuggingfacePyTorch开源项目模型模型下载量化方法
BioMistral-7B-GGUF项目提供支持2至8位量化的GGUF格式模型文件,专为生成多语言的医学和生物文本而设计。由BioMistral创建,该模型兼容多种客户端和库,如llama.cpp,支持GPU加速。其兼容Autotrain和endpoints,可集成至LangChain环境。用户能借助如llama-cpp-python的工具实现快速下载和部署,旨在提升文本生成任务的性能,为高级对话和叙事应用提供支持。
Mixtral-8x7B-Instruct-v0.1-GGUF - Mixtral-8x7B多语言模型的GGUF量化版本
AI模型GGUFGithubHuggingfaceMistral AIMixtral 8X7B开源项目模型量化
本项目提供Mixtral-8x7B-Instruct-v0.1模型的GGUF量化版本。GGUF格式支持CPU和GPU高效推理,项目包含2至8比特多种量化等级文件。模型支持英、法、意、德、西等语言,适用多种NLP任务。用户可通过llama.cpp等工具便捷运行这些模型。
Gemma-2b-it-GGUF - 多样化选择的Gemma量化模型
GithubGoogleHuggingfaceLlamaEdgegemma-2b-it开源项目模型量化
该项目以多种量化格式提供Gemma模型,从低质量损失的小型号到几乎无质量损失的大型号,满足多样化的应用需求。模型的量化由Second State Inc.负责,旨在优化性能和存储空间,适合多种AI部署环境。选择合适型号可在性能与资源使用间达到平衡。
Llama-3.2-3B-Instruct-uncensored-i1-GGUF - 多种量化选项助力模型性能与效率优化
GithubHugging FaceHuggingfaceLlama-3.2-3B-Instruct-uncensored使用指南开源项目机器学习模型模型量化
项目提供多种量化选项,包括i1-IQ1_S到i1-Q6_K不同规格的GGUF文件,满足研究和开发中的多样化需求。用户可参考TheBloke的指南了解使用方法,实现实际应用中的性能和效率优化,同时保持模型输出质量与资源利用的平衡。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号