Project Icon

superpowered

多平台实时低延迟音频SDK及开发工具集

这是一个开源项目,提供跨平台C++音频、网络和加密SDK。主要特点包括低功耗和实时低延迟处理,支持Android、iOS、macOS等多种系统。SDK功能涵盖音频播放、解码、效果器、流媒体等,适用于桌面、移动和嵌入式设备开发。项目还集成了网络通信和加密模块,为开发者提供全面的音频应用开发工具。

sonobus - 实时多人音频流传输应用程序
GithubSonoBus低延迟多人连接开源项目跨平台音频流媒体
SonoBus是一款开源的实时音频流传输应用程序,支持通过互联网或本地网络进行多人高质量、低延迟的音频连接。该工具适用于远程音乐创作、播客录制等场景,提供延迟和音质的精细控制。SonoBus具备输入压缩、噪声门和均衡器等功能,可作为独立应用在多个操作系统上运行,也可作为音频插件在DAW中使用。此外,SonoBus支持无损PCM和Opus压缩音频传输,满足不同的音质需求。
whisper.cpp - 跨平台自动语音识别模型推理工具
Apple SiliconGithubOpenAI Whisperwhisper.cpp开源项目语音识别高性能
whisper.cpp是基于OpenAI Whisper的C/C++自动语音识别(ASR)模型实施,针对Apple Silicon经过优化,并支持多平台部署。该项目以极低的内存消耗和CPU/GPU推理能力,覆盖Mac OS、iOS、Android等主流平台,提供灵活的API与多样的定制模型,使开发者能够轻松地融合语音功能。
versatile_audio_super_resolution - 开源音频超分辨率工具 适用多种类型和采样率
AudioSRGithub开源项目深度学习音频处理音频超分辨率
AudioSR是一个开源的音频超分辨率项目,旨在提高各类音频的质量。它可处理音乐、语音和环境声等多种音频类型,支持所有采样率。该工具提供Gradio演示界面和命令行操作,方便用户使用和批量处理音频。项目在GitHub上持续更新,为音频处理技术提供了新的解决方案。
whisper - 跨平台音频转文本开源项目
FFMPEGGithubWhisperWhisper.cppopen source开源项目音频转文字
Whisper是OpenAI开发的开源项目,使用whisper.cpp和FFMPEG将音频转换为WAV格式并提取文本。项目支持客户端和服务器端运行,无需互联网。目前代码和文档正在优化,接受捐赠以支持持续更新。适用于Android、Linux、Windows、iOS和macOS系统,安装和使用便捷,提供详尽文档和丰富资源。
cheetah - 实时本地化语音转文字引擎
CheetahGithub实时转录开源项目本地处理语音转文字跨平台
Cheetah是一款本地化实时语音转文字引擎,具有隐私保护、高精度和跨平台特性。该引擎支持Linux、macOS、Windows、Android、iOS和主流浏览器等多种平台。Cheetah为开发者提供多种编程语言的SDK和演示应用,支持实时麦克风输入和音频文件处理,是一个灵活的语音识别解决方案。
WebAV - 基于WebCodecs的Web视频处理SDK
GithubWebAVWebCodecs开源项目浏览器兼容性视频编辑音频处理
WebAV是基于WebCodecs技术的Web视频处理SDK,支持跨平台运行且无需服务器。该SDK具有高性能、小体积、易扩展等特点,保护用户隐私。WebAV适用于视频编辑、直播、批量音视频处理等场景,为开发者提供丰富的功能和灵活的扩展性。
Superpowered - 自动会议笔记生成工具,提升会议效率
AI工具AI笔记Superpowered会议记录生产力工具自动化
Superpowered是一款智能会议辅助工具,通过实时音频转录自动生成高质量会议笔记。无需录音或机器人,支持多语言,提供多种会议模板,保护用户隐私。这款工具可帮助与会者专注于会议内容,提高工作效率,成为现代职场的得力助手。
firebase-cpp-sdk - 跨平台开发库集成多种云服务
C++FirebaseGithubSDK开源项目移动应用开发跨平台开发
firebase-cpp-sdk是Firebase提供的开源C++ SDK,支持Android、iOS和桌面平台开发。该SDK集成了分析、身份验证、实时数据库、动态链接等多种Firebase服务。采用CMake构建系统,便于跨平台开发,并提供详细的构建指南和示例。开发者可将Firebase功能轻松集成到C++项目中,提升应用开发效率和用户体验。
audioFlux - 多维音频与音乐分析特征提取库,支持深度学习
GithubMIRaudioFlux开源项目深度学习特征提取音频分析
audioFlux是一个开源工具库,专注于音频和音乐的分析及特征提取。支持多种时间频率变换方法和多种特征组合,适用于分类、分离、音乐信息检索(MIR)和自动语音识别(ASR)等任务。该库跨平台且核心由高性能C语言实现,支持FFT硬件加速,适合大规模数据处理。最新版本引入了多种音高算法及音高移位和时间伸缩算法。
Airplay-SDK - 跨平台无线投屏方案 支持多设备同屏和有线镜像
AirplayGithubWindows安卓开源项目投屏镜像
Airplay-SDK是一个跨平台屏幕镜像项目,支持Android和Windows系统。该方案具有低延迟、高分辨率、多设备同屏等特点,适用于会议和教育场景。项目兼容Airplay、DLNA等协议,支持USB有线投屏和竖屏显示。此外还包含4K视频播放、投屏反控等功能,并提供多平台源代码,为开发者和用户提供全面的屏幕共享解决方案。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号