miniaudio

轻量级跨平台音频库支持播放捕获和高级功能

miniaudio是一个C语言编写的单文件音频库，无外部依赖，支持主流桌面和移动平台。它提供简洁灵活的API，包含低级和高级接口，实现声音管理、混音、音效和3D空间化。该库还包括节点图系统、资源管理、音频编解码、重采样和通道映射等功能，适用于各种音频开发需求。

访问官网

Github

文档

论文

介绍相关项目

tone - 跨平台音频元数据编辑器支持多种音频格式

C#Githubtone元数据编辑开源项目跨平台音频标签

tone是一款跨平台音频元数据编辑工具，支持mp3、m4b和flac等多种格式。该工具可查看和修改音频文件的基本信息如标题、艺术家、专辑，以及封面和章节等高级内容。tone无需依赖，可作为单一可执行文件在主流操作系统使用。它还提供文件名模式自动设置标签和自定义JavaScript高级处理功能。

LCUI - 轻量级C语言跨平台GUI开发库

CSS引擎C语言库GithubLCUI开源项目用户界面跨平台

LCUI是一款轻量级的C语言图形用户界面库,专注于探索创新的UI开发方法。它支持跨平台开发,提供自定义绘制组件和内置CSS引擎,同时融合了TypeScript、JSX和React等现代前端技术。LCUI特别适合开发小型桌面应用和学习GUI编程,为开发者提供了便捷的工具和灵活的开发体验。

librosa - Python音频分析库处理音乐和声音

GithubPython包librosa开源软件开源项目音乐处理音频分析

librosa是一个开源的Python音频分析库，用于音乐和声音处理。它提供音频加载、特征提取、频谱分析等功能，支持多种音频格式。librosa适用于音乐信息检索、音频特效制作和声学研究等领域。该库集成了信号处理算法，并提供文档和示例。librosa适合各级音频处理开发者使用。

Maix-Speech - AI嵌入式设备快速语音处理库

ASRGithubMaix-SpeechTTS嵌入式设备开源项目语音识别

Maix-Speech是一款面向嵌入式设备的AI语音库，涵盖语音识别、对话系统和文本到语音转换等多种功能，目前支持中文。此项目遵循Apache 2.0许可证。

AudioLDM2 - 多功能文本到音频生成开源项目

AudioLDM 2Github人工智能开源项目文本生成音频深度学习音频合成

AudioLDM2是一个开源的文本到音频生成项目，支持创建音效、音乐和语音。该模型能生成超过10秒的音频，输出高达48kHz的高保真音频，并与Hugging Face Diffusers库集成。AudioLDM2提供多个预训练检查点，适用于不同生成任务，支持CPU、CUDA和MPS设备。用户可通过命令行或Web应用程序使用，提供灵活的音频生成选项。项目还包括随机种子调整功能，可优化不同硬件上的性能表现。支持批量生成和自动质量控制，允许用户生成多个候选音频并选择最佳结果。此外，项目提供了详细的使用说明和参数设置选项，方便用户根据需求调整生成过程。

mpv - 跨平台开源命令行媒体播放器

Githubmpv命令行媒体播放器开源软件开源项目跨平台

mpv是一个开源的命令行媒体播放器，支持广泛的媒体格式和编解码器。它采用GPLv2或更新版本许可，可在Linux、Windows和macOS上运行。mpv提供硬件解码和着色器渲染等功能，并支持脚本扩展。项目社区活跃，定期更新以优化播放性能。

easy-speech - 跨浏览器语音合成的简单解决方案

Easy SpeechGithubJavaScriptWeb Speech API开源项目语音合成跨浏览器

Easy Speech是一款跨浏览器语音合成库，无需额外依赖。它提供统一API接口和异步操作支持，具备全局及特定语音实例的事件钩子。该项目能自动检测加载可用语音，并解决了多个浏览器特有问题。Easy Speech还包含内部日志功能，支持多种构建目标，并提供在线演示测试浏览器兼容性。它简化了Web Speech API在主流浏览器上的语音合成实现。

Stable Audio Open - 开源文本转音频模型生成高质量短音频样本和音效

AI工具Stable Audio Open开源模型文本到音频音效制作音频生成

Stable Audio Open是一个开源的文本转音频生成模型，专注于创建短音频样本、音效和音乐制作元素。用户可通过文本提示生成最长47秒的高质量音频。该模型适用于创建鼓点、乐器片段、环境音效和拟音效果等。作为免费开源工具，它为音乐制作和声音设计提供了实用的解决方案。用户可以使用自己的数据微调模型，生成个性化音效。此外，模型支持部署到个人设备，便于自定义使用。

vst3sdk - 专业音频插件开发SDK

GithubVST3开发SDK开源项目系统要求跨平台音频插件

VST3 SDK作为专业音频插件开发框架,具备灵活API和多样化功能。主要特性包括动态I/O配置、精确参数自动化和3D音频支持。该SDK支持跨平台开发,提供示例代码和详细文档。适用于需要开发高质量音频插件的专业开发者。

Crystal - 跨平台多语言文字转语音合成引擎

Crystal TTSGithubSSML规范动态模块加载多语言开源项目跨平台

Crystal TTS Engine通过C++开发，支持多语言合成，以SSML标准方便模块间交互。此外，该引擎支持动态模块加载及跨平台功能，适合开发需支援多语言环境的开发者。

相关项目

推荐项目

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com