Project Icon

Merlin

GPU加速推荐系统解决方案 助力大规模数据处理与模型训练

Merlin是NVIDIA开发的开源库,为推荐系统提供GPU加速解决方案。它包含多个组件如NVTabular和HugeCTR,支持大规模数据处理、特征工程、模型训练和部署。Merlin能处理数百TB数据,通过GPU加速提升系统性能。它兼容TensorFlow、PyTorch等框架,便于构建和优化推荐模型。

DeepLearningExamples - 优化深度学习训练和部署的最佳实践
CUDA-XDeep LearningGithubNGCNVIDIATensor Cores开源项目
提供最新的深度学习示例,使用NVIDIA CUDA-X软件栈在Volta、Turing和Ampere GPU上运行,确保最佳的可重复精度和性能。示例通过NGC容器注册表每月更新,包含最新的NVIDIA贡献和深度学习软件库,支持计算机视觉、自然语言处理、推荐系统、语音识别、文本到语音转换、图神经网络和时间序列预测模型。
generative-recommenders - 基于万亿参数序列转录器的生成式推荐系统框架
GithubHSTU序列模型开源项目性能基准推荐系统深度学习
HSTU是一个基于万亿参数序列转录器的生成式推荐系统框架。该项目在MovieLens和Amazon Reviews等公开数据集上进行了实验,结果显示HSTU在各项指标上均优于现有方法。项目开源了实验代码、配置文件和高效推理所需的Triton内核实现,方便研究者复现结果和进行后续研究。
Savant - 构建高效实时AI流媒体应用,提升数据中心和边缘设备性能
DeepStreamGithubJetsonNvidiaSavant实时视频分析开源项目
Savant是一个基于Nvidia技术的开源框架,专用于构建高效的实时流媒体AI应用。它简化了动态推理管道的开发,并通过DeepStream技术优化数据中心和边缘设备的性能。无论是构建实时还是高负载的计算机视觉和视频分析应用,Savant都提供了灵活、可扩展且易于维护的解决方案。支持Jetson和dGPU各种型号,包含丰富的适配器和SDK,适用于各类视频源和接收端。
recommenders - 利用TensorFlow构建推荐系统模型的库
GithubKerasTensorFlow Recommenders开源项目推荐系统数据准备模型训练
TensorFlow Recommenders 是一款利用TensorFlow构建推荐系统模型的库。它涵盖了数据准备、模型构建、训练、评估和部署的完整工作流程,基于Keras,旨在为用户提供易学且灵活的体验,能够支持构建复杂模型。只需确保安装TensorFlow 2.x,并使用pip安装即可开始使用。详细的文档和教程能够帮助用户快速入门。
TriForce - 层级推测解码实现长序列生成的高效无损加速
GithubTriForce开源项目推理加速无损加速深度学习长序列生成
TriForce是一种新型长序列生成加速技术,无需额外训练即可使用。通过层级推测解码方法,该技术在保持生成质量的同时大幅提高速度。TriForce支持多种长上下文Llama模型,提供片上和卸载运行模式以适应不同硬件。在A100和RTX 4090等GPU上,TriForce展现出优异性能,为大型语言模型的高效部署开辟新途径。
BERT-GPU - 单机多GPU加速BERT预训练的开源实现
BERTGithub多GPU预训练开源项目数据并行深度学习自然语言处理
BERT-GPU项目为BERT模型在单机多GPU环境下的预训练提供了开源实现。该项目无需Horovod即可实现数据并行,通过增加GPU数量扩大批处理规模,从而加速训练过程。项目包含详细的训练流程和参数配置说明,并提供了下游任务的实验结果。这种方法在维持模型性能的同时,有效提升了预训练效率。
RecStudio - 基于PyTorch的模块化推荐系统库 支持多任务多模型
GithubPyTorchRecStudio开源项目推荐系统机器学习深度学习
RecStudio是一个基于PyTorch的模块化推荐系统库。它支持通用、序列、知识、特征和社交等多种推荐任务。该框架提供灵活的模型结构、统一的数据处理、GPU加速、简洁的模型分类和多种负采样方法。RecStudio为推荐系统研究和开发提供了高效便捷的工具。
SHARK - 跨平台机器学习分发解决方案
GithubSHARKStable DiffusionTurbineVulkantorch-mlir开源项目
SHARK是一个高性能的机器学习分发平台,支持Windows、Linux和macOS,兼容AMD和Nvidia硬件,优化图像和文本生成的效率和稳定性。利用最新的Turbine技术,促进更快速的模型部署和稳定性能体验。详细指南帮助初学者和开发者快速上手,支持稳定扩散、BERT、GPT2等热门模型。
RecBole - 基于Python和PyTorch的推荐系统框架,支持91种算法和43个数据集
GithubPyTorchPythonRecBoleRecBole2.0开源项目推荐系统
RecBole是一个基于Python和PyTorch的推荐系统框架,旨在高效地复现和开发推荐算法。该框架包含91种算法,涵盖通用推荐、序列推荐、情境推荐和知识推荐四大类。RecBole支持43个基准数据集,并提供GPU加速和标准评估协议以满足研究需求。最新版本增加了扩展包,提升用户体验,并支持多GPU和混合精度训练。
ColossalAI - 提升大型AI模型训练的效率和可访问性
AI加速Colossal-AIGithub人工智能分布式训练大模型并行训练开源项目热门
Colossal-AI致力于使大型AI模型的训练更加经济、快速且易于获取。通过支持多种并行策略,包括数据并行、流水线并行、张量并行和序列并行,Colossal-AI可以大幅提高大规模模型训练的速度。此外,还集成了异构训练和零冗余优化器技术,使得在多GPU集群上的训练过程更加高效和灵活。Colossal-AI通过这些先进的功能,已被广泛应用于生产和研究场景,显著推动了AI技术的进步和应用。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号