Project Icon

NoiseTorch

Linux系统开源噪音抑制工具 提升音频清晰度

NoiseTorch-ng是一款专为Linux系统开发的开源噪音抑制应用。该工具支持PulseAudio和PipeWire音频系统,通过创建虚拟麦克风来过滤背景噪音,如机械键盘声和电脑风扇声。NoiseTorch-ng采用RNNoise技术,可轻松集成到各类会议和网络通话应用中。它的设置过程简单快捷,仅需两步即可完成,是改善音频质量的实用工具。

OpenVoiceOS - 开源语音平台 实现跨设备语音控制
AI工具OpenVoiceOS多平台开源语音助手社区驱动自定义语音界面
OpenVoiceOS是社区驱动的开源语音平台,致力于创建跨设备语音控制界面。平台支持自然语言处理,提供可定制界面,重视隐私安全。适用于多种设备,包括嵌入式设备和单板计算机,方便DIY智能音箱制作。OpenVoiceOS为开发者提供实验环境,可在Linux和开源语音助手项目中测试新功能。支持Docker和Python安装,并为Raspberry Pi和Mycroft设备提供预构建镜像。
sonobus - 实时多人音频流传输应用程序
GithubSonoBus低延迟多人连接开源项目跨平台音频流媒体
SonoBus是一款开源的实时音频流传输应用程序,支持通过互联网或本地网络进行多人高质量、低延迟的音频连接。该工具适用于远程音乐创作、播客录制等场景,提供延迟和音质的精细控制。SonoBus具备输入压缩、噪声门和均衡器等功能,可作为独立应用在多个操作系统上运行,也可作为音频插件在DAW中使用。此外,SonoBus支持无损PCM和Opus压缩音频传输,满足不同的音质需求。
audio-preprocess - 开源音频处理工具集
Fish Audio PreprocessorGithubPython工具开源项目音频处理音频预处理
Fish Audio Preprocessor是一个开源音频处理工具集,提供视频/音频转wav、人声分离、自动切片和音量匹配等功能。它支持音频数据统计、重采样和转录,未来计划集成WhisperX技术。该项目在Ubuntu系统上测试通过,可通过pip安装,并提供命令行界面。适用于需要批量处理音频的开发者和研究人员。
WhisperLive - 基于OpenAI Whisper模型开发的实时音频转写应用
GithubOpenAI WhisperTensorRTWhisperLive多语言模型实时语音识别开源项目
WhisperLive是基于OpenAI Whisper模型开发的实时音频转写应用,能高效地将直播或预录音频转换成文本。支持多语言和自定义设置,适用于个人、教育及商业场景。项目还提供Docker部署,简化安装和服务部署过程。
Soundux - 跨平台音效板:简洁易用的音频管理工具
GitHubGithubLinux开源开源项目跨平台音板
Soundux是一款开源的跨平台音效板软件,具有简洁的用户界面。它支持在Linux系统将音频播放到特定应用程序,在Windows系统播放到VB-CABLE接收器。软件提供深色和浅色主题、搜索功能、应用程序直通和多音频同时播放控制等特性。Soundux为Linux和Windows用户提供了灵活的音频管理和播放解决方案。
whisper-clip - 一键音频转文本,自动保存到剪贴板
GithubOpenAIWhisperClip剪贴板开源项目自动转录音频转录
WhisperClip是一款自动转录音频并将文本直接保存至剪贴板的工具。只需点击按钮即可将口语转换为书面文本。应用支持Python 3.8及以上版本,使用OpenAI的Whisper技术,无论GPU还是CPU都能选择合适的模型以确保最佳性能。用户可以提供反馈并参与改进项目。
EchoTorch - 高效回声状态网络研究工具库
EchoTorchGithubPyTorch回声状态网络开源项目研究工具神经网络
EchoTorch是基于PyTorch的回声状态网络研究工具库,专注于实现和测试多种ESN模型。该库提供丰富的ESN组件、数据集和评估工具,支持概念器和内存管理等高级功能。EchoTorch的模块化设计便于集成到深度学习架构中,为ESN研究提供灵活性。它还包含数据转换、优化算法和可视化工具,是进行ESN相关实验和研究的理想选择。
HeardThat - HeardThat应用让智能手机助力清晰对话
AI工具HeardThat听力辅助噪音环境智能手机应用语音分离
HeardThat是一款智能手机应用,专门设计用于改善嘈杂环境中的对话体验。通过先进的语音分离技术,该应用可以有效过滤背景噪音,提升语音清晰度。用户只需连接现有的蓝牙耳机或助听器,即可将智能手机变为实用的助听工具。HeardThat不仅适合听力障碍人士,也为任何在社交场合中难以听清对话的人提供了实用解决方案,有助于改善社交互动体验。
whisperX - 高效准确的长音频自动转录工具
GithubWhisperX对齐开源项目时间戳语音识别说话人分离
WhisperX是一款基于Whisper的开源自动语音识别工具,通过强制音素对齐和语音活动批处理技术,实现了高达70倍实时的转录速度。它提供精确的单词级时间戳和说话人分离功能,适用于长音频的高效转录和分析。WhisperX在保持高转录质量的同时,显著提升了时间戳的准确性,为音频处理领域带来了新的可能。
EarTrumpet - 增强Windows音频管理的高级工具
EarTrumpetGithubWindows开源项目系统托盘音量控制音频管理
EarTrumpet是一款获得Microsoft Store社区选择奖的Windows音频管理工具。它提供多通道音频可视化、独立音量混音器、应用程序播放设备切换和默认设备管理等功能。支持自动更新、深浅主题、自定义快捷键,并已本地化为20多种语言。EarTrumpet为Windows用户提供了精细化的音频控制选项,是系统默认音量管理的替代方案。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号