Project Icon

amodem

音频调制解调库实现无网络数据传输

amodem是一个Python实现的音频调制解调库,可通过声卡实现计算机间的数据传输。它支持多种调制方式和采样率,使用OFDM技术,最高可达80kbps的传输速率。该项目适用于空中隔离或有线连接的场景,为无网络环境下的数据交换提供了解决方案。

drachtio-freeswitch-modules - 增强实时通信应用的开源FreeSWITCH模块集
Freeswitch模块Githubdrachtio开源项目语音识别音频处理
drachtio-freeswitch-modules是一个为drachtio应用设计的开源FreeSWITCH模块集。包含音频流转发、Google语音转文本、Dialogflow集成等模块,能够增强实时通信应用的功能。虽然项目不再积极维护,但对于需要高级音频处理和语音交互的FreeSWITCH应用开发者来说,仍是valuable参考资源。项目兼容性强,支持FreeSWITCH 1.8版本。
dasp-pytorch - 基于PyTorch的可微分音频信号处理器库
GithubPyTorch信号处理开源项目深度学习神经网络音频处理
dasp-pytorch是一个基于PyTorch的可微分音频信号处理库。它实现了混响、失真、动态范围处理、均衡和立体声处理等功能,可用于虚拟模拟建模、参数估计、自动DSP和风格迁移。该库支持CPU和GPU批处理,有助于加速训练和优化性能。作为开源项目,dasp-pytorch在Apache 2.0许可下可免费用于学术和商业目的。
FLAML - 高效的Python库,用于自动化机器学习和模型调优
AutoMLFLAMLGithubPython开源项目机器学习模型优化
FLAML是一款轻量级且高效的Python库,旨在简化大语言模型和机器学习模型的自动化工作流程。通过多智能体对话框架和经济高效的自动调优功能,它帮助用户找到优质模型并优化GPT-X工作流。FLAML支持代码优先的AutoML和调优,能处理大规模搜索空间和复杂约束,广泛适用于分类、回归等任务。适用于Python 3.8及以上版本,并提供详细文档和多种扩展选项,满足用户的不同需求。
SpeechMOS - 简化语音质量评估的开源工具
GithubMOS预测PyTorchSpeechMOS开源项目语音质量评估音频处理
SpeechMOS是一款开源的语音质量评估工具,通过简单的代码即可预测主观语音得分。该项目支持多种MOS预测系统,包括UTMOS强模型,可用于评估语音自然度。SpeechMOS使用torch.hub加载模型,无需额外导入库,支持批量处理,适用于语音合成评估等多种场景。这个工具为研究人员和开发者提供了便捷的语音质量评估方法。
cboard - 增强和替代通信网络应用,支持40种语言和多种符号库
AACCboardGithubWeb应用开源项目语言障碍通讯板
Cboard是针对语言和言语障碍人士(如自闭症和脑瘫患者)设计的网页应用,提供点击符号和文字到语音的通信方式。应用收录了多个主流AAC图标库的数千个符号,并支持40种语言,兼容多种设备平台。Cboard借助浏览器的语音合成API来实现交流,致力于帮助全球更多的儿童找到他们的声音。
amphi-etl - Python低代码ETL工具 支持多类型数据处理
AI管道Amphi ETLGithubPython低代码开源项目数据处理
Amphi-etl是一款现代ETL工具,专注于AI时代的数据处理需求。它通过低代码界面加速数据和AI管道开发,生成可移植的Python代码。支持多样化数据处理,包括结构化和非结构化数据的导入、转换和导出。提供私有化部署,保障数据安全与隐私。
voicefixer_main - 语音修复框架,支持严重退化和历史语音的恢复
GithubVoiceFixer开源项目神经声码器训练评估语音恢复
VoiceFixer 为一款专业语音修复框架,致力于修复严重退化或历史性语音。集成多种先进算法,适用于去噪音、消除回声、提升语音清晰度等多种场景,提供灵活的配置和广泛的测试支持。
sionna - 基于TensorFlow的开源通信系统仿真库推动物理层创新
GithubSionnaTensorFlow开源库开源项目深度学习通信系统
Sionna是一个开源Python库,利用TensorFlow进行数字通信系统的链路级仿真。该项目为物理层研究提供了实用工具,支持GPU加速,并配有多种示例和教程。研究人员和工程师可以通过pip或Docker安装使用。Sionna致力于提升性能和用户体验,为通信系统的开发和优化创造了便利条件。
friendly-stable-audio-tools - 改进后的Stable Audio Tools开源框架支持音频生成模型训练和推理
AI音频生成GithubStable Audio开源项目模型训练深度学习音乐生成
该项目是对Stability AI的stable-audio-tools的重构和增强,提供了音频和音乐生成模型的开源代码。重构后的代码提高了可读性和易用性,并新增了评估和使用自训练模型的脚本。项目详细说明了如何训练Stable Audio 2.0等模型,并提供了Stable Audio Open 1.0的使用文档和便捷脚本。此外,项目支持多GPU/节点生成,并集成了Gradio界面用于测试模型。
matchering - 智能音频匹配与母带处理工具
GithubMatchering 2.0Python库开源项目母带处理音频匹配音频处理
Matchering 2.0是开源音频处理工具,提供容器化Web应用和Python库。基于目标音轨和参考音轨比对,自动调整RMS、频率响应、峰值振幅和立体声宽度,实现专业级母带处理。支持多种音频格式,可用于风格模仿、专辑统一和音频实验,为音乐制作者提供灵活高效的解决方案。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计 是一个多功能的在线设计和创意平台,提供广泛的设计工具和资源,以满足不同用户的需求。从专业的图形设计师到普通用户,无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑,稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合,帮助用户轻松实现创意设计。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号