Project Icon

Meraj-Mini-GGUF

多精度量化GGUF语言模型 适配多平台本地部署

Meraj-Mini-GGUF项目提供Meraj-Mini模型的GGUF格式版本,支持2-bit至8-bit量化精度。GGUF作为llama.cpp团队开发的新型模型格式,具备卓越性能和广泛兼容性。该模型可在LM Studio、text-generation-webui等主流平台运行,支持GPU加速,适合本地部署文本生成任务。项目兼容多种客户端和库,如llama.cpp、GPT4All等,为用户提供灵活的应用选择。

Qwen2-1.5B-Instruct-GGUF - Qwen2-1.5B指令模型的GGUF格式压缩版本
GGUFGithubHuggingfaceQwen人工智能开源项目模型语言模型量化模型
本项目提供Qwen2-1.5B-Instruct模型的GGUF格式文件,包含多种量化级别。GGUF是llama.cpp团队开发的新格式,取代了旧有的GGML。这些文件兼容多个支持GGUF的平台,如llama.cpp和LM Studio,便于高效本地部署和推理。项目提供多种选择,可适应不同性能和资源需求。
CausalLM-7B-GGUF - 基于CausalLM 7B的双语语言模型量化优化方案
CausalLMGGUFGithubHuggingfacellama.cpp开源项目模型语言模型量化
CausalLM 7B模型GGUF格式转换项目提供多种量化版本实现。该模型支持中英双语能力,基于多个数据集训练。项目包含2比特到8比特的不同量化方案,适配各类硬件环境。完整的部署文档和兼容性说明确保模型可快速应用。
MiniCPM-V-2_6-gguf - 高性能GGUF格式多模态模型转换与部署指南
GithubHuggingfaceMiniCPM-V多模态开源项目推理模型模型转换量化
MiniCPM-V-2.6是一个支持GGUF格式转换的多模态模型项目。项目展示了PyTorch模型到GGUF格式的转换流程,实现F16和INT4量化,并在Linux及Mac平台实现本地部署。项目提供完整的模型转换、构建和推理步骤,方便开发者进行多模态模型的本地化部署。
WizardLM-1.0-Uncensored-CodeLlama-34B-GGUF - GGUF格式提供AI应用的新选择
AI助手GithubHuggingfaceWizardLM 1.0 Uncensored CodeLlama 34B开源项目模型模型格式模型量化量化方法
GGUF格式由llama.cpp团队在2023年8月推出,旨在取代不再支持的GGML格式。新格式提升了分词能力,支持特殊标记并包含元数据,设计得更加可扩展。多个客户端和库已兼容GGUF格式,例如llama.cpp、text-generation-webui和KoboldCpp等,为用户提供了更强大的AI模型选择和应用功能。此外,该项目包含具有不同量化参数的AWQ和GPTQ模型,用于GPU推理,并支持多位GGUF模型文件,以满足不同的应用场景需求。
laser-dolphin-mixtral-2x7b-dpo-GGUF - 跨平台兼容的量化模型:GGUF格式的应用与性能评估
GithubHuggingfaceLLMLaser Dolphin Mixtral 2X7B DPOMacadeliccc变压器开源项目模型量化
GGUF格式开创了一种新的模型优化方法,适用于多平台的机器学习应用,带来更优的性能与存储管理。该项目兼容多个用户界面,如llama.cpp和KoboldCpp,并支持多种量化文件格式,推荐选用Q4_K_M和Q5_K_M以实现性能与资源消耗的最佳平衡。
Ministral-3b-instruct-GGUF - 更高效的量化语言模型,为文本生成带来显著性能提升
Apache 2.0GithubHuggingfaceNLPtransformers开源项目模型模型量化语言模型
Ministral-3b-instruct-GGUF是一个基于llama.cpp的高效量化模型,专为Ministral系列的3B参数设计优化,并从Mistral-7B进行微调。它使用混合数据集,主要用于英语文本生成。通过量化技术,该模型在保持精度的同时,显著减少了存储和计算需求,理想应用于高效文本生成场景。项目遵循Apache 2.0许可协议,以确保合规使用。
medicine-LLM-13B-GGUF - 专业级医学大语言模型GGUF格式量化版本
GGUFGithubHuggingfaceMedicine LLM医学人工智能大语言模型开源项目模型模型量化
本项目提供AdaptLLM开发的Medicine LLM 13B模型的GGUF量化版本。GGUF是llama.cpp团队推出的新格式,替代了旧有的GGML。项目包含2位到8位精度的多种量化版本,可适应不同硬件配置和性能需求。GGUF文件兼容多种客户端和库,便于用户灵活使用。量化版本在优化资源使用的同时,也保证了模型质量。
solar-pro-preview-instruct-GGUF - 高效量化的GGUF格式Solar-Pro-Instruct模型
GGUFGithubHuggingfacellama.cppsolar-pro-preview-instruct开源项目文本生成模型量化模型
该项目提供Solar-Pro-Preview-Instruct模型的GGUF格式文件,支持2-8位量化。GGUF是llama.cpp团队开发的新格式,替代了旧有的GGML。这一格式广泛应用于llama.cpp、LM Studio等多个流行的本地部署工具和库中,为高效的本地文本生成任务提供支持。
gemma-2-27b-it-GGUF - Gemma-2-27b-it模型的多精度GGUF量化版本
GemmaGithubHuggingfaceLlamaEdge大语言模型开源项目推理服务模型模型量化
Gemma-2-27b-it模型的GGUF量化版本提供2至16比特的多种精度选项。基于LlamaEdge框架,支持8192上下文窗口,可通过WasmEdge以服务或命令行方式运行。Q4_K_M和Q5_K_M版本在模型大小和性能间取得平衡,适合多数应用场景。
gemma-2-27b-it-GGUF - gemma-2-27b-it模型的GGUF量化版本适配多种硬件配置
GGUF格式GithubHuggingfacegemma-2-27b-it大语言模型开源项目文件下载模型模型量化
本项目提供gemma-2-27b-it模型的多种GGUF量化版本,涵盖从高质量Q8_0到紧凑型IQ2_M。用户可根据RAM和VRAM选择适合的模型。项目包含下载指南、模型选择建议和性能对比,便于部署和使用这些优化模型。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能,包括文生视频、动态画面和形象生成等,帮助用户快速上手,创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台,用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品,帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型,为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能,满足事务性工作的高频需求,帮助撰稿人节省精力,提高效率,优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号