NoiseTorch

Linux系统开源噪音抑制工具提升音频清晰度

NoiseTorch-ng 降噪 Linux 虚拟麦克风开源软件 Github 开源项目

NoiseTorch-ng是一款专为Linux系统开发的开源噪音抑制应用。该工具支持PulseAudio和PipeWire音频系统，通过创建虚拟麦克风来过滤背景噪音，如机械键盘声和电脑风扇声。NoiseTorch-ng采用RNNoise技术，可轻松集成到各类会议和网络通话应用中。它的设置过程简单快捷，仅需两步即可完成，是改善音频质量的实用工具。

访问官网

Github

介绍相关项目

WaveGrad - 高效实现高保真语音生成的WaveGrad技术

GithubWaveGrad声码器并行训练开源项目混合精度高保真生成

WaveGrad是Google Brain开发的依托去噪扩散概率模型(DDPM)技术的高保真语音合成工具。这一项目特别适用于高迭代推理，并且能在不同硬件上包括单GPU环境进行稳定高效的训练。其主要特点包括高保真声音生成、多迭代支持及分布式训练功能。预训练模型及灵活架构配置加强了其实用性和适应性。

MockingBird - 全面支持中文的语音克隆与合成解决方案

GithubMockingBirdPyTorch中文支持开源项目热门训练模型音频合成

MockingBird项目是一款支持中文的语音克隆工具，支持多数据集和各种操作系统，包括Windows和Linux，甚至M1 MACOS。该项目利用最新的PyTorch技术，提供易于使用的界面和高效的处理能力，只需训练新的合成器即可实现令人印象深刻的效果。此外，该项目还提供了Web服务器功能，允许远程调用。是否需要定制语音合成解决方案，MockingBird都能满足您的需求。

throttled - Linux系统Intel CPU性能优化工具

CPU throttlingGithubIntelLinux功耗限制开源项目性能优化

throttled是一款针对Linux系统优化Intel CPU性能的开源工具。它通过周期性覆盖MSR和MCHBAR默认值,调整CPU功率限制和温度阈值,防止嵌入式控制器重置这些参数。此外,throttled还提供CPU降压、IccMax调整和HWP覆盖等高级功能,全面提升CPU性能。该工具适用于多种笔记本型号,可有效解决Intel CPU在Linux系统下的节流问题。

use-whisper - 适用于OpenAI Whisper API的React Hook，支持语音录制和静音消除

GithubOpenAIReact HookuseWhisper实时转录开源项目语音识别

useWhisper 是一个为 OpenAI Whisper API 提供的 React Hook，具备语音录制、实时转录和静音消除功能。正在开发的 React Native 版本将使移动应用开发更便捷。用户可以通过 npm 或 yarn 安装，并通过丰富的配置和回调函数实现自定义转录。主要依赖项包括 recordrtc、lamejs、ffmpeg、hark 和 axios，是开发者进行语音处理和转录的理想工具。

DN-DETR - 创新查询去噪技术加速目标检测训练

DETRGithub开源项目注意力机制深度学习目标检测计算机视觉

DN-DETR通过创新的查询去噪技术加速DETR目标检测模型训练。该方法仅需50%训练周期即可达到基线模型性能,大幅提高训练效率。项目开源了DN-DETR、DN-Deformable-DETR等多个模型实现,并提供详细的模型库、使用指南和安装说明,便于研究者复现结果或将去噪训练应用于其他模型。

Supertone Shift - 实时语音转换器

AI工具AI音频Supertone ShiftVTubers实时语音转换无需GPU热门语音自定义音频生成

Supertone Shift提供领先的实时变声技术，具备广泛的声音库和简易操作界面，支持即时切换声音，适合VTubers、内容创作者和游戏玩家。兼容多种平台如Discord、VRChat和Twitch，无需GPU，适用于多种设备。加入公开测试，体验通讯的未来发展。

mumble - 多平台兼容的低延迟开源语音聊天程序

GithubMumbleMurmurQt开源软件开源项目语音聊天

Mumble是一个开源的低延迟语音聊天程序，基于Qt和Opus技术构建。它由客户端(mumble)和服务器(murmur)组成，支持多种操作系统。Mumble的主要特点包括高音质、跨平台兼容性和插件扩展能力，适合各类用户和团队进行稳定、可靠的语音通信。

insanely-fast-whisper-api - 音频转文字的高速开源API，支持GPU云部署与并发处理

DockerGithubJigsawStackWhisper API开源开源项目转换音频

这是一款基于OpenAI Whisper Large v3的API，能够高速将音频转录为文字。此开源项目支持在任意支持GPU的云提供商上部署，内置说话人分离功能，提供易用的Fast API层、异步后台任务和Webhooks，优化了并发处理。支持任务管理、取消与状态查询，拥有安全的管理员认证访问。通过Docker可以轻松部署到包括Fly.io在内的多种VM环境，实现高效的生产用途。

AudioDec - 流式高保真神经音频编解码开源项目

AudioDecGithub开源开源项目流式传输神经音频编解码器高保真

AudioDec项目开发了一种流式高保真神经音频编解码器，可以12.8 kbps的比特率处理48 kHz单声道语音。该编解码器在GPU上解码延迟约6毫秒，CPU上约10毫秒。项目采用两阶段训练方法，利用预训练模型可快速为新应用训练编码器。AudioDec在压缩率、延迟和重建质量方面均表现优异，适用于实时通信等场景。

相关项目

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号