Project Icon

audapolis

多媒体编辑器提供文字处理器式体验

audapolis是一款开源的多媒体编辑工具,为口语媒体编辑提供类似文字处理器的操作体验。该工具支持音频自动转录为文本,适用于视频、音频和混合编辑,可用于制作广播节目、播客、有声书和采访片段等内容。audapolis重视用户隐私,采用本地存储方式,无需云端服务。该软件支持Windows、Linux和macOS平台,致力于简化媒体编辑工作流程。

AudioGPT - 多功能音频生成与理解平台,支持语音、音乐、音效及虚拟人对话
AudioGPTGithub开源项目语音增强语音识别音乐生成音频合成
AudioGPT 是一个多功能音频生成与理解平台,具备语音合成、语音识别、语音分离、风格迁移、声音检测、声音提取、文本到音频转换等功能,还支持音乐生成与虚拟人对话。集成了 FastSpeech、whisper、GeneFace 等多个领先的基础模型,AudioGPT 为开发者提供强大的开源工具和预训练模型,支持多种音频相关任务,不断扩展其功能和应用场景。此平台适合音频处理、自然语言处理及多模态研究的需求。
buzz - 离线音频转录与翻译工具,基于OpenAI Whisper技术
BuzzGithubOpenAIWhisper开源项目應用商店热门音频转录
Buzz是一款运行于个人电脑上的离线音频转录与翻译工具,使用OpenAI的Whisper技术,能够高效地转录并翻译音频内容。该应用提供Mac App Store专用版本,具有更清晰的界面和更丰富的功能,如音频回放、拖放导入、转录编辑和搜索等。对于不同操作系统,Buzz提供了简便的安装方式,包括Windows, macOS和Linux。Buzz旨在提供无缝和高效的用户体验,以满足广泛的个人和专业需要。
Recorder - 多平台支持的HTML5录音和实时音频处理库
GithubHTML5录音Recorder实时转码开源项目浏览器兼容性音频处理
Recorder是一款跨平台HTML5录音库,支持实时音频处理、格式转换和可视化。兼容大多数现代浏览器及移动设备,适用于语音录制、实时语音识别等场景。支持MP3、WAV等多种音频格式,提供丰富插件和API,便于开发者实现复杂音频处理。除浏览器环境外,Recorder还可用于微信小程序和uni-app等应用中。
transcribe - 多语言实时转录和对话生成的开源工具
GithubOpenAITranscribe多语言支持安全功能实时转录开源项目
这个开源项目提供多语言实时转录,通过选择OpenAI GPT-4o、GPT-4、GPT-3.5等模型生成对话响应。软件具有最新的OpenAI库支持,无需Python依赖即可安装使用,并提供高安全性功能。支持麦克风和扬声器输入转换,用户可以定制提示、保存聊天记录,并可享受离线免费和在线付费的语音到文本转换服务。该工具在有GPU支持时性能最佳,并提供详细的安装指南和用户支持。
picard - 跨平台音频标签编辑应用 功能强大
GithubMusicBrainz Picard开源软件开源项目跨平台应用音乐元数据音频标签
MusicBrainz Picard是一款跨平台音频标签编辑应用,支持多种音频格式。它采用AcoustID音频指纹识别技术和专辑导向的标签方法,结合MusicBrainz数据库,实现精确音乐标记。该应用还提供CD查询、插件扩展、脚本语言和封面下载等功能,适合音乐爱好者整理音频文件。
Transcriptmate - 高精度自动音频转文字平台
AI工具Transcriptmate文字记录自动转录语音转文字音频处理
Transcriptmate平台提供自动音频转文字服务。支持多语言,可处理3小时内录音,2小时完成转录。输出多种文件格式,适用于内容创作者、记者等。具备人声分离、AI内容生成功能。按需付费,无需订阅,为用户提供高效音频处理解决方案。
echogarden - 多功能语音处理工具集支持跨平台使用
EchogardenGithub开源项目文本转语音语音处理语音工具集语音转文本
Echogarden 是一个功能全面的开源语音处理工具集,提供文本转语音、语音识别、语音对齐和翻译等多项功能。该工具集适用于 Windows、macOS 和 Linux 平台,安装和使用简便。Echogarden 采用 TypeScript 开发,通过 WebAssembly 和 ONNX 运行时实现跨平台兼容,无需复杂依赖。目前主要提供命令行界面,支持批量处理,未来计划开发图形界面和交互式工具。
FFMPerative - 基于自然语言的智能视频编辑工具
FFMPerativeGithub人工智能命令行工具开源项目自然语言处理视频编辑
这是一款基于大型语言模型(LLM)的创新视频编辑工具,通过聊天界面接收自然语言指令。支持视频速度调整、尺寸变更、裁剪、翻转等功能,还提供语音转文字和字幕添加服务。该工具旨在简化视频编辑流程,适用于各级用户,有助于提高编辑效率。无论是专业人士还是业余爱好者,都能轻松完成复杂的编辑任务。
Edit-Videos-Online - 多功能在线视频编辑器 支持自动生成字幕和添加音频
AI工具在线视频编辑字幕生成水印添加添加文字音频添加
Edit-Videos-Online是一款功能丰富的在线视频编辑器,支持多种常见视频格式。该工具提供自动生成字幕、添加文字、音频和水印等功能,无需注册或安装软件即可使用。用户可以轻松编辑视频内容,包括添加字幕、文本、音乐和旁白,以及调整各种视频参数。这个在线平台适合需要快速处理视频的用户,提供了便捷高效的视频编辑体验。
AudiowaveAI - AI驱动的文本转语音技术提供媲美有声读物的音频体验
AI工具AudiowaveAI人工智能创业文本转语音音频学习
AudiowaveAI是一种创新的文本转语音解决方案,提供媲美有声读物的音频质量。其特点包括自然流畅的语音合成、多样化的语音风格和灵活的定价选项。这款工具适合企业和个人用户,支持随时随地学习和阅读。通过提供卓越的音频体验,AudiowaveAI有效提升了信息获取和知识吸收的效率。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计 是一个多功能的在线设计和创意平台,提供广泛的设计工具和资源,以满足不同用户的需求。从专业的图形设计师到普通用户,无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑,稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合,帮助用户轻松实现创意设计。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号