#NeMo

GenerativeAIExamples学习资料汇总 - NVIDIA开源的生成式AI参考工作流

2 个月前

NVIDIA RAG LangChain Triton NeMo Github 开源项目

2 个月前

NVIDIA GenerativeAIExamples：加速生成式AI工作流的开源项目

3 个月前

NVIDIA RAG LangChain Triton NeMo Github 开源项目

3 个月前

相关项目

GenerativeAIExamples

NVIDIA提供的生成式AI示例，使用CUDA-X软件栈和NVIDIA GPU，展示快速部署、测试和扩展AI模型的方法。包括最新的RAG管道构建技巧、实验性示例和企业应用，支持本地和远程推理，集成流行LLM编程框架，并附有详细开发文档。

parakeet-tdt_ctc-1.1b

parakeet-tdt_ctc-1.1b提供了一个功能强大的语音识别模型，支持将语音转录为包含标点和大写字母的文本。由NVIDIA NeMo和Suno.ai团队联合开发，拥有1.1B的参数规模，能够高效地处理大规模的音频数据。该模型利用局部注意力和全局令牌技术实现单次处理11小时音频。其在多个公开数据集上的出色表现，表明其在语音转录应用中有广泛的适用性和较低的词错误率（WER）。

parakeet-ctc-1.1b

parakeet-ctc-1.1b是由NVIDIA NeMo和Suno.ai团队开发的ASR模型，采用FastConformer架构，参数量约11亿。该模型适用于16kHz单声道音频，可以转录语音为小写英文。经过多数据集测试，字错率表现优异，如LibriSpeech clean数据集WER为1.83。利用NVIDIA NeMo工具包，该模型可用于推理或微调，适合多领域音频转录。

uzbek-speaker-verification-v4

提供预训练的乌兹别克语说话人验证模型，适合语音识别任务，支持NeMo工具包中的推理和微调。模型经过大量语音数据训练，在标准语音识别中表现良好，适用于学术研究和商业应用。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com