Project Icon

nccl-rdma-sharp-plugins

NCCL插件,支持RDMA和SHARP的GPU通信优化工具

nccl-rdma-sharp-plugins是NVIDIA NCCL库的扩展插件,为GPU通信提供RDMA和SHARP支持。该项目依赖MOFED、CUDA等组件,使用GNU autotools进行构建。通过优化GPU间数据交换,该插件可提升分布式深度学习等场景的通信效率。项目开源,适合需要高性能GPU通信的开发者和研究人员使用。

UnrealSharp - 为虚幻引擎5带来C#和.NET 8开发支持
C#GithubUnrealSharp开源项目插件游戏开发虚幻引擎
UnrealSharp是为虚幻引擎5开发的插件,实现了C#和.NET 8在UE5项目中的应用。它提供C#与UE5的无缝集成,具备热重载、自动绑定和NuGet包支持等特性。该插件与UE5最新特性和API兼容,为C#开发者优化了工作流程。目前支持UE5.3+版本,未来将扩展更多功能支持。
llm.c - 纯C和CUDA实现的高效轻量级语言模型训练框架
CUDAC语言GPU训练GithubLLM开源项目
llm.c是一个使用纯C和CUDA实现的高效轻量级语言模型训练框架。该项目不依赖PyTorch或cPython等大型框架,通过简洁代码实现GPT-2和GPT-3系列模型的预训练。llm.c支持单GPU、多GPU和多节点训练,提供详细教程和实验示例。项目在保持代码可读性的同时追求高性能,适用于教育和实际应用。此外,llm.c支持多种硬件平台,并有多个编程语言的移植版本。
opencvsharp - 多平台.NET OpenCV封装库 实现计算机视觉
.NETGithubOpenCvSharp图像处理开源项目计算机视觉跨平台
OpenCvSharp是一个开源的.NET OpenCV封装库,支持Windows、UWP和Ubuntu等多个平台。它模仿OpenCV C/C++ API风格,提供自动资源管理和格式转换功能。开发者可通过NuGet包轻松使用该库实现图像处理和计算机视觉应用。OpenCvSharp为.NET生态系统带来了OpenCV的强大功能,促进了跨平台计算机视觉开发。
tiny-cuda-nn - 专注于快速训练和查询神经网络的开源框架
C++编程CUDAGPUGithubTiny CUDA Neural Networks开源项目深度学习
Tiny CUDA Neural Networks是一个紧凑、高效的开源框架,专注于快速训练和查询神经网络。它包含优化的多层感知器(MLP)和多分辨率哈希编码,并支持多种输入编码、损失函数和优化器。适用于NVIDIA GPU,通过C++/CUDA API和PyTorch扩展,助力高性能计算和深度学习项目。
Displacement-MicroMap-Toolkit - NVIDIA置换微网格工具包创建与查看解决方案
GithubNVIDIA工具包开发开源项目微置换图渲染
NVIDIA置换微网格工具包提供库、样例和工具,用于创建和查看置换微网格。它支持gltf格式资产处理,包含置换微贴图烘焙和GPU加速重网格化功能。工具包配备图形化工作台,便于微网格检查和工具交互。基于Displacement Micro-Map技术,需要支持VK_NV_displacement_micromap的驱动程序。
ncps - NCP、LTC 和 CfC 有线神经模型的 PyTorch 和 TensorFlow 实现
CfCGithubLTCNeural Circuit PoliciesPyTorchTensorFlow开源项目
神经电路策略(NCPs)是一种设计稀疏递归神经网络的方法,灵感来源于秀丽隐杆线虫的神经系统。该开源项目提供与PyTorch和TensorFlow兼容的模块,增强可审计的自主性。其安装步骤简便,并且提供了丰富的文档和互动教程,帮助用户从基础到复杂模型的创建。多种示例和教程,包括在Google Colab上的演示,让用户快速掌握NCPs的应用。
CUDA-GEMM-Optimization - CUDA实现的GEMM优化与性能分析
CUDAGEMMGPU优化Github开源项目性能分析矩阵乘法
该项目展示了一系列针对通用矩阵乘法(GEMM)的CUDA内核优化实现。内容涵盖从基础到高度优化的多个GEMM内核版本,并提供了详细的性能分析。这些内核适用于任意矩阵大小,并针对NVIDIA GeForce RTX 3090 GPU进行了参数调优。项目包含Docker环境配置说明、编译运行指南,以及FP32和FP16 GEMM的性能对比,直观展示了不同优化技术对性能的影响。
TensorFlow.NET - 用 C# 实现完整的 Tensorflow API,允许 .NET 开发人员使用跨平台的 .NET Standard 框架开发、训练和部署机器学习模型
.NETGithubKerasTensorFlowTensorFlow.NET开源项目机器学习
TensorFlow.NET为.NET Standard框架提供了TensorFlow绑定,使.NET开发者能够使用C#或F#进行机器学习模型的开发、训练和部署。项目内置Keras高级接口,支持将Python代码无缝移植到.NET环境,适用于Windows、Linux和MacOS系统,并支持CPU和GPU版本。
oneDNN - 优化深度学习应用的跨平台性能库,支持多种处理器架构
CPU优化GithubUXL Foundationdeep learningoneAPI specificationoneDNN开源项目
oneAPI Deep Neural Network Library (oneDNN) 是一个开源的跨平台性能库,提供深度学习应用的核心模块。oneDNN 专为Intel架构处理器、Intel图形处理器和Arm 64位架构处理器进行优化,并实验性支持NVIDIA、AMD、OpenPOWER、IBMz 和 RISC-V 等架构的 GPU 和 CPU。深度学习应用及框架开发者可以利用oneDNN提升在多种硬件上的性能表现。
DeepSpeed - 大模型的训练工具
AI工具AI开发AI系统技术DeepSpeed大规模训练模型压缩模型训练热门高性能计算
DeepSpeed是一个先进的深度学习优化工具库,专门设计用于简化和增强分布式训练。通过一系列创新技术,如ZeRO、3D并行处理、MoE和ZeRO-Infinity,DeepSpeed能大幅提高训练速度,同时降低成本。这些技术支持在数千GPU上扩展模型训练,并实现低延迟和高吞吐量的推理性能。DeepSpeed同时提供了先进的模型压缩技术,优化模型存储与推理效率,是大规模AI模型训练和推理的优选方案。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计 是一个多功能的在线设计和创意平台,提供广泛的设计工具和资源,以满足不同用户的需求。从专业的图形设计师到普通用户,无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑,稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合,帮助用户轻松实现创意设计。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号