Project Icon

qwen.cpp

Qwen-LM的高性能C++实现

qwen.cpp是Qwen-LM的开源C++实现,基于ggml开发,支持实时对话、纯C++ tiktoken和流式生成。项目兼容x86/arm CPU、NVIDIA GPU,适用于Linux和MacOS平台。提供模型量化、Python绑定等功能,可在本地设备运行高性能Qwen对话模型。

whisper.unity - 本地语音识别与多语言翻译工具
ASRGithubOpenAIUnitywhisper.cppwhisper.unity开源项目
whisper.unity项目为Unity3d提供了whisper.cpp的绑定,支持在本地运行OpenAI Whisper自动语音识别模型。具备约60种语言支持、多语言翻译和多种模型尺寸选择,可在Windows、MacOS、Linux、iOS和Android等平台上高效运行,且无需互联网连接。项目完全开源,支持商业用途,并支持CUDA和Metal加速。
LlamaGPTJ-chat - 简单C++命令行聊天程序,兼容GPT-J、LLaMA及MPT模型
C++GPT-JGithubLLaMALlamaGPTJ-chatMPT开源项目
一个使用C++编写的命令行聊天程序,支持GPT-J、LLaMA、MPT等语言模型。适用于Linux、MacOS和Windows系统,有详尽的安装和使用指南,并支持多线程、保存/加载聊天日志、设置AI角色等多种功能。
LLM.swift - 多平台兼容的大型语言模型交互Swift库
GithubHuggingFaceModelLLM.swiftSwiftasynclarge language models开源项目
`LLM.swift` 是一个简洁易用的库,支持在macOS、iOS、watchOS、tvOS和visionOS上与大型语言模型本地交互。开发者可通过SPM或直接复制代码在Xcode项目中使用。此库基于`llama.cpp`,性能优越,并保持与最新更新同步。其设计允许自定义输入预处理、输出后处理及动态更新功能,并支持从HuggingFace获取模型数据,适用于跨平台高效语言模型交互的需求。
TinyChatEngine - 面向边缘设备的高效语言模型推理库
AWQGithubLLMSmoothQuantTinyChatEngineVLM开源项目
TinyChatEngine是一个专为边缘设备设计的语言模型推理库,支持运行大型语言模型(LLM)和视觉语言模型(VLM)。该库采用SmoothQuant和AWQ等先进的模型压缩技术,兼容x86、ARM和CUDA等多种平台架构,无需依赖外部库。TinyChatEngine具备跨平台兼容性、高性能和易用性等特点,能在笔记本电脑、汽车和机器人等设备上实现实时推理,提供快速响应的同时保护数据隐私。
ncnn - 移动端神经网络推理框架
Githubncnn开源项目深度学习神经网络移动平台腾讯
ncnn 是一个专为移动端设计,无第三方依赖的开源神经网络推理框架。它支持跨平台功能,低内存占用及在手机CPU上的高速运算能力。利用 ncnn,开发者能够迅速在移动应用中部署深度学习模型,加入智能化功能。该框架已在众多应用程序中使用,如QQ和微信。同时,ncnn 支持 Vulkan API,优化了GPU加速功能,致使在移动设备上表现卓越。
rust-llama.cpp - Rust语言下的LLaMA模型绑定库
GPUGithubLLama.cppRust开源项目模型绑定
rust-llama.cpp是一个开源项目,为LLaMA.cpp提供Rust语言绑定。这个库使开发者能在Rust环境中集成和使用LLaMA大语言模型。项目支持cuBLAS、OpenBLAS和OpenCL等硬件加速选项,并已实现GPU(Metal)支持。通过简洁的API接口,开发者可以方便地加载模型和生成文本。rust-llama.cpp还支持GGUF格式,为Rust开发者提供了一个功能全面的LLaMA模型集成工具。
ppl.llm.kernel.cuda - 优化大语言模型计算的CUDA内核库
AI计算CUDAGPU加速GithubPPL LLM开源项目深度学习
ppl.llm.kernel.cuda是PPL.LLM系统的核心组件,为大语言模型提供CUDA内核实现。该项目针对Ampere和Hopper架构优化,支持x86_64和arm64平台。它提供简单的构建流程,包含NCCL和JIT编译选项,便于性能调优。作为开源项目,ppl.llm.kernel.cuda旨在提高大规模语言模型的计算效率,为AI开发提供底层支持。
RWKV-LM - 高性能并行化RNN,探索和应用RWKV模型
GithubRNNRWKVTransformer并行化开源项目性能
RWKV是一个高性能的并行化RNN,具有变换器级别的性能。该模型实现了快速的推理和训练速度,不依赖于传统的注意力机制,而是通过隐藏状态进行计算,优化了VRAM的使用,并支持处理无限长度的文本上下文。RWKV的这些特点使其在进行句子嵌入和处理复杂文本任务时显示出优越的能力。
vllm - 高性能与易用性的LLM推理与服务平台
GithubLLM服务PagedAttentionvLLM开源项目量化高吞吐量
vLLM是一个高性能且易用的LLM推理与服务平台,具备PagedAttention内存管理、CUDA/HIP图形加速、量化支持、并行解码算法及流式输出等技术优势。vLLM无缝集成Hugging Face模型,兼容多种硬件设备,支持分布式推理和OpenAI API。最新版本支持Llama 3.1和FP8量化。用户可通过pip安装并参考详细文档快速入门。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号