willow-inference-server

高性能语言推理的开源自托管解决方案

Willow Inference Server ASR TTS CUDA WebRTC Github 开源项目

Willow Inference Server (WIS) 是一个高效的开源语言推理服务器，支持自托管并优化了CUDA和低端设备的使用。在减少内存和显存占用的前提下，能够同时加载多种语言模型。WIS 支持语音识别 (ASR)、文本到语音合成 (TTS) 以及大语言模型 (LLM)，并通过 REST、WebRTC 和 WebSockets 等多种传输方式，实现实时、低延迟的语音与语言处理，适用于各类助理任务和视障用户。

访问官网

Github

Huggingface

介绍相关项目

quillman - 开源的实时语音转录和语言模型对话应用

GithubMetavoice Tortoise TTSModalOpenAI WhisperQuiLLManZephyr开源项目

一个开源项目，提供实时语音转录和自然语音合成的聊天应用，使用Zephyr语言模型和OpenAI Whisper技术。适用于开发和实验自定义语言模型应用，可在Modal平台上无服务器部署。提供在线演示、详细文档和模块化结构，方便本地开发和部署。

speculative-decoding - 推测解码技术，优化大型语言模型推理速度

GithubSpeculative Decoding大语言模型开源项目性能优化推理加速自然语言处理

该开源项目聚焦于推测解码技术的研究与实现，旨在提升大型语言模型的文本生成效率。项目涵盖了多种推测解码策略，包括提前退出、推测采样和先知变压器。同时，项目致力于优化批处理推测解码，以增强整体性能。研究计划还包括对比不同策略的效果，并探索微观优化方法。这些工作为加快AI模型推理速度提供了新的技术思路。

selfhostedAI - 兼容OpenAI接口的自托管AI项目，支持多种模型与应用

APIChatGLMGithubSelf-Hosted AIllama.cppstable-diffusion-webui开源项目

selfhostedAI是兼容OpenAI接口的自托管AI项目，支持多种开源模型如RWKV、ChatGLM 6B和llama.cpp，以及绘画模型stable-diffusion-webui。项目提供一键安装程序和详细教程，可在本地或云端运行，实现文本生成、对话及绘画功能。此外，还集成了text-generation-webui和Wenda，简化安装和配置流程。

KuiperInfer - 开源轻量级深度学习推理框架

C++GithubKuiperInfer大模型开源项目推理框架深度学习

KuiperInfer是一个开源深度学习推理框架，支持Resnet、Yolov5和LLama2等主流模型。基于现代C++设计，该框架提供高效算子实现和优化技术，适用于图像分类、目标检测和自然语言处理任务。KuiperInfer不仅是实用的推理工具，还是学习深度学习框架设计和C++工程实践的优质资源。

IntelliNode - 集成多种AI模型的统一接口、评估与生产模块

AI集成GithubIntelliNode图像生成开源项目语义搜索语言模型

IntelliNode 是一个 JavaScript 模块，能将先进的 AI 技术集成到项目中。通过直观的函数调用，可生成文本、语音或图像，并切换使用 ChatGPT、LLaMA、WaveNet、Gemini 和 Stable Diffusion 等模型。主要功能包括语义搜索、多模型评估和聊天机器人。简单 npm 安装后即可使用最新 AI 模型，详情参见文档和示例代码。

llm-awq - 激活感知权重量化技术实现大语言模型高效压缩与加速

AWQGithubLLM开源项目模型量化视觉语言模型边缘设备

AWQ是一种高效的大语言模型低比特权重量化技术，支持INT3/4量化，适用于指令微调和多模态模型。它提供预计算模型库、内存高效的4位线性层和快速推理CUDA内核。AWQ使TinyChat可在边缘设备上实现大模型高效本地推理。该技术已被Google、Amazon等采用，并获MLSys 2024最佳论文奖。

InternVL2-2B-AWQ - 跨多语言多图像任务的高效视觉语言模型

API接口GithubHuggingfaceInternVL2-2B图像文本多模态开源项目模型模型量化

InternVL2-2B-AWQ以AWQ算法实现4bit权重量化，模型推理速度较FP16提升至2.4倍。lmdeploy兼容众多NVIDIA GPU进行W4A16推理，提升离线批量推理效率。同时，该项目提供RESTful API服务并兼容OpenAI接口，快速部署和应用于视觉-语言任务。此多语言兼容的模型不仅提高推理效率，还具备灵活的服务特性。

gdansk-ai - 开源全栈AI语音对话系统整合多项云服务

AI语音聊天机器人Auth0GithubOpenAIStripe全栈AI应用开源项目

Gdańsk AI是一个开源的全栈AI语音对话系统，集成了语音转文本、大型语言模型和文本转语音技术。该项目整合了Auth0身份验证、OpenAI和Google Cloud API的AI能力，以及Stripe支付功能。系统由Web应用、API和AI组件构成，为开发者提供完整的AI对话解决方案。用户可通过购买'bibs'代币与AI进行语音交互。本项目采用Node.js、TypeScript和Python等技术栈，结构清晰，便于二次开发。系统支持用户通过语音进行AI对话，并提供便捷的支付流程。开发者可根据需求自定义AI模型和对话流程，快速构建语音交互应用。

speech-to-text-benchmark - 开源语音识别基准测试框架对比多家主流引擎

Github基准测试开源项目模型大小计算效率识别准确率语音转文本

该项目提供了一个开源的语音识别基准测试框架，对比了Amazon、Azure、Google等主流云服务以及OpenAI Whisper、Picovoice等引擎的性能。框架使用LibriSpeech、TED-LIUM和Common Voice数据集，评估词错率、计算效率和模型大小等指标。测试结果客观展示了各引擎在准确度和资源消耗方面的表现，为选择语音识别解决方案提供了参考依据。

相关项目

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能，包括文生视频、动态画面和形象生成等，帮助用户快速上手，创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台，用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品，帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型，为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能，满足事务性工作的高频需求，帮助撰稿人节省精力，提高效率，优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号