Project Icon

Whisperboard

提供的语音转录服务的开源iOS应用

WhisperBoard是一款开源iOS应用,基于OpenAI的Whisper模型,为用户提供高质量的语音转录服务。用户可通过简单操作开始录音,并进行高级语音转录。此应用支持音频文件的导入与导出,并可灵活选择录音麦克风,以确保最佳音质。用户还可以在应用中浏览和下载不同的Whisper模型,以满足不同需求。未来功能包括实时转录和可恢复转录进程。

WhisperSpeech - 多语言支持的开源文本转语音系统,功能强大并易于定制
GithubWhisperSpeech多语言支持开源模型开源项目文本转语音语音克隆
WhisperSpeech是基于开源Whisper框架开发的文本至语音系统,提供了商业级安全的语音合成解决方案。当前支持英语LibreLight数据集,并计划拓展到多语言支持。用户可通过在线Colab平台体验其高效的语音合成和声音克隆功能。
insanely-fast-whisper - 高效率开源语音转录命令行工具
AI模型CLI工具GithubWhisper开源项目性能优化语音转录
Insanely Fast Whisper是一款开源的高性能语音转录命令行工具,基于Transformers、Optimum和Flash Attention技术。该工具支持OpenAI的Whisper Large v3模型,能够在98秒内处理150分钟的音频。通过Flash Attention 2和批处理等优化,大幅提升了转录效率。适用于NVIDIA GPU和Mac设备,用户可通过简单的命令实现快速准确的音频转录。
Transcribro - 安卓设备本地语音识别键盘
AndroidGithubTranscribro开源软件开源项目语音识别隐私保护
Transcribro是一款安卓语音识别键盘和服务,采用OpenAI Whisper模型和Silero VAD技术。它提供语音输入功能,可作为独立应用或被其他程序调用。所有处理在设备本地进行,确保用户隐私和数据安全。Transcribro支持多种应用场景,为用户提供便捷的语音转文字体验。
WhisperBot - WhatsApp语音消息转文字工具,提升沟通效率
AI助手AI工具OpenAIWhatsAppWhisperBot语音转文字
WhisperBot是一款集成于WhatsApp的语音转文字工具。它支持57种语言,转录准确率达95%。用户只需转发语音消息,即可获得文字内容,无需安装额外应用。WhisperBot基于OpenAI技术,不仅能高效转录,还可提取长语音消息的关键要点。该工具重视用户隐私,使用WhatsApp的端到端加密,并在转录后删除所有相关数据,确保安全性。
WhisperWizard - macOS智能语音转文字工具 提升写作效率
AI工具AI转录WhisperWizardmacOS应用自定义模板语音转文字
WhisperWizard是专为macOS设计的智能语音转文字工具,利用ChatGPT将口述内容转换为优质书面文字。适用于邮件、文档等多种场景,减少打字错误,节省时间。支持自定义模板,实现例行任务快速处理。提供历史录音快速检索,方便回顾和使用过往内容。这款工具旨在提高写作效率,为macOS用户提供智能语音转文字解决方案。
insanely-fast-whisper-api - 音频转文字的高速开源API,支持GPU云部署与并发处理
DockerGithubJigsawStackWhisper API开源开源项目转换音频
这是一款基于OpenAI Whisper Large v3的API,能够高速将音频转录为文字。此开源项目支持在任意支持GPU的云提供商上部署,内置说话人分离功能,提供易用的Fast API层、异步后台任务和Webhooks,优化了并发处理。支持任务管理、取消与状态查询,拥有安全的管理员认证访问。通过Docker可以轻松部署到包括Fly.io在内的多种VM环境,实现高效的生产用途。
use-whisper - 适用于OpenAI Whisper API的React Hook,支持语音录制和静音消除
GithubOpenAIReact HookuseWhisper实时转录开源项目语音识别
useWhisper 是一个为 OpenAI Whisper API 提供的 React Hook,具备语音录制、实时转录和静音消除功能。正在开发的 React Native 版本将使移动应用开发更便捷。用户可以通过 npm 或 yarn 安装,并通过丰富的配置和回调函数实现自定义转录。主要依赖项包括 recordrtc、lamejs、ffmpeg、hark 和 axios,是开发者进行语音处理和转录的理想工具。
whisper-asr-webservice - 基于Whisper的开源语音识别Web服务
DockerGPU支持GithubWhisper ASR开源项目语音识别
whisper-asr-webservice是一个开源的语音识别Web服务,基于OpenAI Whisper模型。它支持OpenAI Whisper和Faster Whisper引擎,提供多语言语音识别、翻译和语言识别功能。项目提供Docker镜像,支持CPU和GPU部署。这个服务具有高性能和易用性,适合各种语音识别应用场景。
whisper-plus - 全面音频处理工具集成语音识别与智能交互
AI模型GithubWhisperPlus开源项目自然语言处理语音转文字
WhisperPlus是一个集成多项功能的开源音频处理工具库。它支持语音转文字、文本摘要和说话人分离等核心功能,并提供YouTube音频下载、多种模型选择以及基于RAG技术的视频内容智能对话能力。此外,WhisperPlus还包含文本转语音和自动字幕生成功能,为开发者提供全面的音频处理解决方案。该项目安装简便,接口灵活,适用于广泛的语音处理应用场景。
superwhisper - 智能语音转文本,为macOS用户打造的私密转录工具
AI工具DockerGPT-4 TurboKubernetesPostgreSQLSaaS
SuperWhisper为macOS用户提供智能语音转文本服务。支持离线使用,确保数据私密性。适用于会议记录、笔记整理等场景,快速将语音转换为文字。采用先进语音识别技术,结合本地处理能力,实现高效、准确的转录。这款工具为macOS用户带来安全、便捷的语音转文本解决方案。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能,包括文生视频、动态画面和形象生成等,帮助用户快速上手,创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台,用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品,帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型,为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能,满足事务性工作的高频需求,帮助撰稿人节省精力,提高效率,优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号