Project Icon

ucc

统一集体通信库 高性能HPC、AI/ML和I/O通信解决方案

UCC(Unified Collective Communication)是一个面向高性能计算、人工智能和大规模I/O的开源集体通信库。它提供灵活且功能丰富的API,支持非阻塞操作、多样化资源分配和同步模型。UCC架构模块化,集成了UCX、SHARP、CUDA和NCCL等多种传输技术,并可无缝对接Open MPI。这一设计使UCC能够在各种计算环境中实现高度可扩展的性能表现。

naturalcc - 弥合编程与自然语言的序列建模工具包
GithubNaturalCC代码理解开源项目机器学习自然语言处理软件工程
NaturalCC是一个开源的序列建模工具包,旨在缩小编程语言与自然语言之间的差距。它支持代码生成、补全、摘要等多项软件工程任务。该工具包采用模块化设计,集成了多个大型代码模型,支持多GPU训练和高效推理。NaturalCC还提供了预处理的基准数据集和评估工具,为代码智能研究与开发提供了全面的解决方案。
cucim - 提升多维图像处理性能的开源库
GPU加速GithubRAPIDScuCIM图像处理多维图像开源项目
cuCIM 是一个开源的高性能多维图像处理和计算机视觉软件库,应用于生物医学、地理空间、材料科学、生命科学和遥感领域。利用基于 GPU 的加速技术,cuCIM 提供了增强的大规模和多维 TIFF 文件处理能力,并且支持简便的 Python 接口和多种图像格式,如 Aperio ScanScope 虚拟切片、Philips TIFF 和多分辨率压缩 TIFF 文件。
open-c3 - 全面整合的DevOps平台 优化CI/CD/CO流程
CI/CD/COGithubOPEN-C3开源项目监控系统资源管理运维系统
Open-C3是一套综合性运维系统,旨在优化CI/CD/CO流程。该系统整合了资源管理、监控、Kubernetes集群管理、工单处理、流程自动化、故障自愈、作业平台、发布管理和成本优化等功能。Open-C3提供统一的解决方案,适用于多云环境,采用高效的网络架构和数据传输机制。系统设计注重易维护性和可升级性,各模块保持独立,便于与企业现有系统对接。通过提供全面的运维工具,Open-C3有效简化了企业的日常运维工作。
open-gpu-kernel-modules - NVIDIA驱动程序fork版实现RTX 4090 GPU间直接通信
GPUGithubLinux驱动NVIDIAP2P支持PCIe开源项目
这个项目是NVIDIA驱动程序的一个分支,为RTX 4090显卡添加了点对点(P2P)通信支持。通过直接利用PCIe总线进行GPU间数据传输,该方案绕过了传统的MAILBOXP2P接口。项目成功实现了P2P功能,并与NCCL兼容,可显著提高多GPU系统性能。这种创新方法遵循PCIe规范,有望被纳入上游驱动程序,为NVIDIA GPU用户提供更高效的计算能力。
unified-io-2 - 跨模态人工智能的开源新标杆
GithubUnified-IO 2人工智能多模态模型开源项目机器学习深度学习
Unified-IO 2是一个开源的多模态AI框架,集成视觉、语言、音频和动作处理能力。项目提供完整代码支持演示、训练和推理,适用于TPU和GPU环境。基于T5X优化,内含多规格预训练模型和丰富数据集。其跨模态学习和生成能力为AI研究与应用提供了新的可能性。项目采用模块化设计,便于研究人员和开发者进行二次开发和定制。Unified-IO 2支持多种数据格式和预处理流程,为不同任务场景提供灵活解决方案。其开源性质促进了AI社区的协作与创新,为多模态AI技术的进步做出贡献。
ROCm - 开源GPU计算软件栈推动高性能与科学计算
GPU计算GithubHIPROCm开源软件开源项目机器学习
AMD ROCm是一个开源GPU计算软件栈,提供完整的驱动、开发工具和API生态系统。它支持从底层内核到终端应用的全方位GPU编程,专门针对高性能计算、人工智能和科学计算领域优化。ROCm支持多种编程模型,并与主流机器学习框架深度集成。通过HIP技术,ROCm实现了卓越的跨平台可移植性,使开发者能够在各类GPU平台上灵活部署代码,适用范围涵盖从普通游戏GPU到大规模超算集群。
aeron - 高性能低延迟的跨平台消息传输框架
AeronGithubIPCUDP开源项目消息传输高性能
Aeron是一个专注于高性能和低延迟的开源消息传输框架。它支持UDP单播、多播和IPC通信,提供Java、C和C++客户端实现。Aeron的核心功能包括跨机器高效消息交换、消息流存档和基于Raft算法的集群容错服务。通过集成Simple Binary Encoding技术,Aeron优化了消息编码和解码性能。该框架设计目标是在各类消息系统中实现最高吞吐量和最低延迟,适用于构建高性能通信系统。
puck - 高效近似最近邻搜索库 专注大规模数据集性能
ANN搜索GithubPuck内存优化向量索引开源项目高性能
Puck是一个高效的C++近似最近邻(ANN)搜索库,其名称来源于莎士比亚作品中的精灵角色。该项目包含Puck和Tinker两种算法,在多个1B数据集上表现出色。Puck采用两层倒排索引架构和多级量化,可在有限内存下实现高召回率和低延迟,适用于大规模数据集。Tinker则针对较小数据集优化,性能超过Nmslib。该库支持余弦相似度、L2和IP距离计算,并提供Python接口,方便开发者集成使用。
ComputeLibrary - 优化Arm架构的开源机器学习函数库
ARM架构Compute LibraryGithub开源软件开源项目性能优化机器学习
ComputeLibrary是一个专为Arm架构优化的机器学习函数库,支持Cortex-A、Neoverse处理器和Mali GPU。它提供100多个低级机器学习函数,覆盖多种数据类型和卷积算法,并采用微架构优化、内核融合等先进技术。作为开源项目,ComputeLibrary具有高性能、高度可配置的特点,为Arm平台的机器学习应用开发提供了强大支持。
unet.cu - UNet扩散模型的高性能CUDA实现
CUDAGithubUNet卷积神经网络图像生成开源项目深度学习
这个开源项目使用纯C++/CUDA实现了UNet扩散模型训练框架,支持无条件扩散。框架包含线性层、组归一化、注意力等核心算子的GPU加速实现,重点优化3x3卷积。通过多次迭代提升CUDA kernel性能,训练速度达PyTorch的40%。项目展示了深度学习框架在GPU上的高效实现过程,为相关开发提供参考。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号