Project Icon

GoWhisper

跨平台本地音频转录应用 注重隐私保护

GoWhisper是一款跨平台桌面应用,专注于本地音频转录,确保用户隐私。支持99种语言转录,适合研究人员、播客主持人和内容创作者使用。应用提供多种AI模型、文件格式支持和导出选项,简化转录流程。其功能包括音频播放、录音转录和文本编辑,为用户提供全面的音频处理方案。

Nutshell - 设备内隐私处理的会议记录工具
AI会议记录AI工具Nutshell个性化提示实时转录隐私保护
Nutshell是一款会议记录工具,通过在用户设备上本地处理数据以确保隐私。适用于macOS 13+(M1, M2, M3+)设备,无需联网即可运行,实时转录会议内容并提供反馈。支持自动捕捉来自各平台的音频,且具备智能助手功能,帮助快速获取会议相关信息和见解。
whisper-tiny.en - 支持时间戳转录的轻量级英语语音识别模型
GithubHuggingfaceONNXTransformers.jsWhisper开源项目时间戳模型自动语音识别
基于transformers.js开发的轻量级英语语音识别模型,集成ONNX格式权重实现Web端部署。模型支持基础文本转录、时间戳转录及单词级时间戳标记等功能,通过JavaScript可快速实现音频转文本识别。
Shush - WhisperV3模型的全栈语音转文本应用演示
GithubModalNextJSShushWhisperV3开源项目音频转录
Shush是一个开源项目,展示了如何在Modal平台上部署WhisperV3语音识别模型,并通过NextJS应用程序实现交互。该项目集成了Next.js前端和Modal后端,演示了高性能模型运行、可靠API构建和自动扩展功能。开发者可以通过此项目学习如何快速部署AI模型后端,并构建响应式前端应用,实现高效的语音转文本功能。
whisperkit-coreml - 针对苹果芯片优化的本地化语音识别开源框架
Apple SiliconCoreMLGithubHuggingfaceWhisperKit开源项目模型设备端语音识别
WhisperKit是一个为苹果芯片设备优化的本地语音识别框架,提供高性能的语音转文本功能。该开源项目托管于GitHub,开发者可以通过Hugging Face上的基准测试评估其在实际设备上的表现。WhisperKit使iOS和macOS应用能够实现先进的本地语音识别,无需依赖云服务。
faster-whisper-medium.en - 优化版Whisper语音识别模型集成CTranslate2框架
CTranslate2GithubHuggingfaceWhisperfaster-whisper开源项目模型模型转换语音识别
faster-whisper-medium.en是OpenAI Whisper-medium.en模型的CTranslate2移植版本,专注于英语音频转文本处理。通过CTranslate2框架优化,支持FP16计算类型,提供Python接口实现音频转录功能,输出包含时间戳的文本片段。项目采用MIT许可证开源,主要面向需要语音识别功能的开发场景。
faster-whisper-tiny - CTranslate2格式Whisper小型模型实现多语言语音识别
CTranslate2GithubHuggingfaceWhisperfaster-whisper开源项目模型自然语言处理语音识别
该项目将OpenAI Whisper小型模型转换为CTranslate2格式,支持100多种语言的语音识别。适用于CTranslate2及其衍生项目如faster-whisper,能高效进行自动语音识别。开发者可通过简单的Python代码实现音频转录,得到包含时间戳的文本段落。模型采用FP16格式存储,可在加载时灵活调整计算类型,为语音识别应用提供了高效且可定制的解决方案。
faster-whisper-large-v2 - 基于Whisper large-v2的高效多语言语音转文本模型
CTranslate2GithubHuggingfaceWhisper开源项目模型模型转换自然语言处理语音识别
该项目是OpenAI Whisper large-v2模型的CTranslate2转换版本,旨在提供高效的自动语音识别功能。支持超过100种语言,通过faster-whisper库实现简便调用。模型采用FP16格式存储,支持运行时计算类型调整,以优化性能。这一工具能够快速准确地完成语音到文本的转换,适用于多种应用场景,为开发者提供了强大的语音识别解决方案。
whisper - Graphite项目的高效时间序列数据存储方案
GithubGraphite项目Whisper开源项目数据存储时间序列数据库脚本工具
Whisper是Graphite项目的核心组件,专为时间序列数据设计的固定大小数据库。它在RRD基础上进行优化,提供快速可靠的数字数据存储,支持高分辨率的近期数据和低分辨率的长期历史数据。Whisper配备多种实用工具脚本,简化数据库的创建、查询、更新和管理。作为Graphite生态系统的关键部分,Whisper为大规模指标监控和分析提供高效的数据存储解决方案。
faster-whisper-tiny.en - 轻量快速的OpenAI Whisper英语语音识别模型
CTranslate2GithubHuggingfaceWhisper开源项目模型模型转换自然语言处理语音识别
faster-whisper-tiny.en是OpenAI Whisper tiny.en模型的CTranslate2优化版本,专门用于英语语音识别。这个模型提供高效的音频转录功能,支持16位浮点量化,可通过faster-whisper库简单集成。它适合需要快速、精确的英语语音转文本解决方案的开发者,特别是在计算资源有限的场景中表现出色。该模型采用MIT许可证,支持音频处理和自动语音识别任务。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能,包括文生视频、动态画面和形象生成等,帮助用户快速上手,创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台,用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品,帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型,为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能,满足事务性工作的高频需求,帮助撰稿人节省精力,提高效率,优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号