Project Icon

gigax

在硬件上运行的 LLM 驱动的 NPC

Gigax提供高效的GPU推理和多功能NPC交互,支持对话、动作和其他自定义行为。采用Llama-3和Phi-3模型,支持本地服务器模式和多语言API,并提供运行时任务生成和记忆存储功能,适用于各种游戏场景。详细信息请访问Gigax官方GitHub页面。

AgentLLM - 用LLM打造自主代理,浏览器端高效运行
AgentLLMChatGPTGithubWebGPUWizardLM开源项目浏览器原生LLM
AgentLLM展示了使用开源大型语言模型(LLM)在浏览器上运行自主代理的潜力,可有效处理复杂的目标导向任务。通过利用WebGPU,项目显著提升了性能,并在无工具简化版的AgentGPT环境中实现。该平台适合于希望快速验证LLM能力的用户,界面友好且功能丰富。
Llama-3.1-Nemotron-70B-Instruct-HF-FP8-dynamic - 多语种量化优化模型,显著降低内存占用
GithubHuggingfaceLlama-3.1-Nemotron-70B-Instruct-HF-FP8-dynamic多语言支持开源项目文本生成模型模型优化量化
通过将权重和激活量化为FP8格式,该项目优化了Llama-3.1-Nemotron模型,显著降低了GPU内存与磁盘的占用。模型适用于商业与研究,支持多语言开发和会话助手的构建。利用vLLM,可以实现高效部署并具有OpenAI兼容性。Llama-3.1-Nemotron-70B-Instruct-HF-FP8-dynamic在诸多测试中表现优良,在Arena-Hard评估中达99.41%的恢复率。
Mistral-7B-v0.1-GGUF - 多平台支持的GGUF格式模型文件,提升推理效率
GPU加速GithubHuggingfaceMistral 7B v0.1开源模型开源项目文本生成模型量化方法
Mistral AI发布的Mistral 7B v0.1模型以GGUF格式支持多种文本生成任务。此格式由llama.cpp团队开发,替代旧的GGML格式,兼容多平台和库,包括支持GPU加速的text-generation-webui、KoboldCpp和LM Studio等。项目提供多样的量化模型文件,适配不同推理需求,保证了启发式使用中的高效性能。用户可通过简单的下载及命令行操作获取模型,并支持Python等语言的集成,为文本生成任务提供了高性能的解决方案。
ROS-LLM - 一个用于具身智能应用的ROS框架
GPT-4GithubROS-LLMROS2开源项目机器人控制自然语言交互
ROS-LLM项目打造了一个使用大语言模型(如GPT-4和ChatGPT)的ROS框架,用于机器人决策和控制。框架易于扩展和集成,只需简单API配置,十分钟内即可完成机器人与ROS-LLM的结合,快速创建互动与控制体验。支持ROS系统,并拥有本地和云端自然语音交互、历史记录保存功能。未来计划增加导航接口和传感器输入接口,以提升机器人导航与环境感知能力。
llama2.go - Go语言实现的LLaMA-2本地推理引擎
GithubGo语言llama2.go大语言模型开源项目性能优化推理
llama2.go项目实现了LLaMA-2模型的本地推理。该引擎使用纯Go语言编写,源于llama2.c项目。它通过命令行界面实现模型加载和文本生成,并采用并行计算、循环展开等技术优化性能。在Apple M1芯片上,llama2.go能够达到39.28 tok/s的推理速度。作为一种轻量高效的方案,该项目为开发者提供了便捷的LLaMA-2本地部署选择。
LlamaGen - 自回归模型在图像生成中的应用和优势
AR模型GithubHugging FaceLlamaGen图像生成开源项目自回归模型
LlamaGen项目展示了自回归模型在图像生成中的潜力,通过无偏视觉信号和大规模数据训练,实现了媲美扩散模型的性能。该项目发布了多种图像tokenizer和生成模型,支持从100M到3B参数的多种配置,并提供在线演示和高效的vLLM服务框架。访问项目页面和在线demo,体验这些创新模型的强大功能。
granite-3.0-8b-instruct-GGUF - 文本生成模型的量化优化与性能提升
GithubHuggingfacegranite-3.0huggingface开源项目数据集文本生成模型量化
项目通过llama.cpp对granite-3.0-8b-instruct模型进行量化优化,适用于低内存环境的高效运行。根据硬件资源,用户可以从多种量化模型中选择,实现性能与质量的最佳平衡。项目支持代码生成、数学推理和多语言处理等任务,并提升了在IFEval、AGI-Eval等数据集上的表现。提供了从高质量全权重到ARM架构优化模型的多种选择,加速模型推断过程,展示了在文本生成领域的有效实践。
DarkIdol-Llama-3.1-8B-Instruct-1.2-Uncensored-GGUF - 优化和下载支持多语言的DarkIdol-Llama文本生成模型
DarkIdol-Llama-3.1-8B-Instruct-1.2-UncensoredGithubHuggingfaceLM Studiohugginface-cli开源项目模型模型下载量化
DarkIdol-Llama模型提供多种量化选项,涵盖多语言输出,适合角色扮演等多种应用场景。通过llama.cpp工具,用户可以选择符合需求的量化模型,以优化推理性能。提供详细的下载指南,帮助用户根据RAM和VRAM的配置选择合适的模型文件,特别推荐高质量的Q6_K_L版本。该模型可在LM Studio上运行,适用于不同硬件条件下的AI研究与开发。
Behemoth-123B-v1-GGUF - 多种量化策略优化文本生成模型效率
Behemoth-123B-v1GithubHuggingface开源项目性能优化文本生成模型模型下载量化
Behemoth-123B-v1-GGUF 项目运用 Llamacpp imatrix 技术进行模型量化,支持从 Q8_0 到 IQ1_M 的多种格式,适应不同硬件环境。项目涵盖多种文件种类,量化质量和大小各异,从高质到低质,满足多样使用需求。用户可根据 RAM 和 VRAM 选择合适文件,平衡速度与质量的追求。Q8_0 格式在嵌入和输出权重方面的质量表现突出,而适用于 ARM 芯片的 Q4_0_X_X 格式则显著提升运算速度,尤其适合低内存硬件。
Llama-2-70B-Chat-GGUF - 支持文本生成与特殊符号的先进开源模型
GithubHuggingfaceLlama 2兼容性开源项目文本生成模型模型文件量化方法
Llama 2 70B Chat项目采用全新GGUF格式,取代已弃用的GGML格式,提升标记化与特殊符号支持功能。此项目由Meta Llama 2开发,兼容多种UI与库,支持多平台GPU加速应用,在文本生成与性能方面提供明显改善。GGUF格式还具备元数据支持,具备更强的扩展性,适用于复杂多变的应用场景。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号