Project Icon

Lumimaid-v0.2-12B-GGUF-IQ-Imatrix

高效量化与SillyTavern兼容的Lumimaid角色扮演模型

采用GGUF-IQ-Imatrix量化方法,高效转换和运行Lumimaid v0.2模型。兼容SillyTavern角色扮演预设,并建议使用最新版本KoboldCpp进行运行。支持低温度预设优化性能,并通过丰富的预设和示例提升角色扮演体验。如有疑问,可参与讨论获取更多支持。

Llama-2-7B-GPTQ - Llama 2 7B的GPTQ量化版本 支持多种参数选项
GithubHuggingfaceLlama 2Meta人工智能大语言模型开源项目模型自然语言处理
该项目提供Meta Llama 2 7B模型的GPTQ量化版本,包含4位精度、多种组大小和Act Order等参数选项。模型文件兼容AutoGPTQ、ExLlama等框架,适用于GPU推理。项目提供了在text-generation-webui使用的说明,以及Python代码调用示例。这些量化版本在保持性能的同时降低显存占用,便于更多用户部署使用Llama 2模型。
MiniCPM-Llama3-V-2_5-gguf - GGUF格式大语言模型轻量化推理工具
GithubHuggingfaceMiniCPMllama.cppollama人工智能开源项目模型模型部署
MiniCPM-Llama3-V 2.5 GGUF是一个针对大语言模型轻量化部署的优化模型文件。通过llama.cpp和ollama框架,开发者可实现模型的本地化推理。项目提供完整的部署文档,支持高效且便捷的本地化实现
Replete-Coder-Llama3-8B-GGUF - 基于llama.cpp优化的高效量化方法提升文本生成性能
GithubHuggingfaceReplete-Coder-Llama3-8B开源项目数据集文本生成模型模型压缩量化
该开源项目利用llama.cpp进行模型量化,适用于HumanEval和AI2推理挑战等任务,提供多种量化选项如Q8_0和Q6_K,适应不同内存要求,同时优化性能表现。I-quant量化在低于Q4时表现良好,用户可依据自己的设备内存和GPU VRAM选择合适的量化格式,通过huggingface-cli便捷获取所需文件。
RoleLLM-public - 评估与提升大语言模型角色扮演能力的框架
GithubRoleLLM基准测试大语言模型开源项目微调角色扮演
RoleLLM框架旨在评估和增强大语言模型的角色扮演能力。该框架包含RoleBench数据集、Context-Instruct知识提取方法、RoleGPT风格模仿技术和RoCIT微调策略。通过这些组件,RoleLLM显著提升了开源模型的角色扮演表现,在某些方面达到了与GPT-4相当的水平。这一框架为大语言模型在角色扮演任务中的应用提供了新的研究方向。
Open_Gpt4_8x7B_v0.2-GGUF - 提供多格式兼容量化模型,提升推理效率
GGUFGithubHuggingfaceOpen Gpt4 8X7B V0.2rombo dawg开源项目模型模型兼容性量化
此项目提供GGUF格式的多精度量化模型文件,旨在优化CPU和GPU的推理效率。作为GGML的替代,GGUF与多种第三方UI和库兼容,支持多平台AI模型的高效运行。项目包含2至8位量化模型以满足不同精度与内存要求,适合多种场景需求。通过详细的下载指导,用户能快速找到适合的模型文件,并利用llama.cpp、text-generation-webui等高性能运行时实现模型在不同硬件上的高效推理。
maid - 支持多种AI模型以及本地和远程接口的跨平台AI模型分发应用
GithubMaid开源开源项目模型接口移动人工智能跨平台应用
Maid是一款跨平台免费开源应用,实现了与本地llama.cpp模型及远程Ollama, Mistral, Google Gemini和OpenAI模型的接口。支持从huggingface直接下载精选模型,并可交互使用sillytavern角色卡,提升用户互动体验。支持包括Windows、MacOS、Linux和Android在内的多种操作系统,确保用户全面便捷的模型管理。
ChatGLM-Efficient-Tuning - 微调ChatGLM-6B模型,支持多种训练和量化方法
ChatGLMGithubRLHF开源项目数据集机器学习高效微调
ChatGLM-Efficient-Tuning项目提供高效微调ChatGLM-6B模型的工具和方法,支持LoRA、P-Tuning V2等多种微调方式,适用于单GPU和多GPU训练。项目还提供Web UI和CLI操作,支持4-bit和8-bit量化训练。通过丰富的数据集和功能,如强化学习和模型评估,满足不同场景的微调需求。详情请参见项目Wiki。
SillyTavern - 探索多功能AI文本生成与角色扮演的交互平台
GithubSillyTavernTavernAI开源项目文本生成AI用户界面角色扮演
SillyTavern是一款基于TavernAI 1.2.8的开源项目改编而来的用户界面,支持安装在计算机和安卓设备上。它支持与多种文本生成AI后端如KoboldAI、Horde、NovelAI等通讯,提供丰富的交互选项包括角色扮演、自定义界面和自动翻译功能。此外,还提供第三方拓展的下载支持。由于其轻量级设计,适合所有类型的设备,无需依赖高端硬件。
SqueezeLLM - 硬件资源优化下的大语言模型量化服务
GithubSqueezeLLM内存优化大语言模型开源项目模型压缩量化
SqueezeLLM通过密集与稀疏量化方法降低大语言模型的内存占用并提升性能,将权重矩阵拆分为易量化的密集组件和保留关键部分的稀疏组件,实现更小内存占用、相同延迟和更高精度。支持包括LLaMA、Vicuna和XGen在内的多个热门模型,提供3位和4位量化选项,适用于不同稀疏度水平。最新更新涵盖Mistral模型支持和自定义模型量化代码发布。
LLM-Kit - 无需编程即可部署和定制多语言模型的工具整合包
GithubWebUIsuqin大模型开发部署开源项目语言模型
LLM-Kit项目通过WebUI整合了多种语言模型工具,实现了无需编程即可配置定制化模型和专业应用。项目支持Windows和Linux操作系统以及多个版本的Python,并提供多种训练和推理功能,包括角色扮演、AI智能体和数据库集成。项目还与众多知名模型和工具库兼容,开发者可以轻松上手并参与贡献,进一步优化和扩展项目功能。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号