Project Icon

nvshare

多进程安全共享GPU的开源解决方案

nvshare是一个开源的GPU共享机制,支持多个进程或Kubernetes容器在同一GPU上安全并发运行。它利用统一内存API和系统RAM作为交换空间,使每个进程都能访问全部GPU内存。通过nvshare-scheduler管理GPU访问时间,有效避免内存抖动。这种方案适用于GPU使用呈突发性的场景,如交互式开发环境中的Jupyter notebooks等。

genv - 开源GPU环境管理系统 简化资源分配与协作
GPU管理GenvGithub开源项目环境配置资源分配集群管理
Genv是一个开源的GPU环境和集群管理系统,为数据科学和机器学习团队提供GPU资源的高效管理。它支持GPU共享、远程访问、无代码切换以及本地LLM部署,显著提升团队协作效率。Genv具备GPU使用监控和配额管理功能,适合多人共享GPU资源的场景。通过与Ollama的集成,Genv能在集群中有效运行和管理大型语言模型。
glake - 优化GPU内存与IO传输
AI训练GLakeGPU内存GithubIO传输优化开源项目
GLake优化了GPU内存管理和IO传输,解决了AI大模型训练和推理中的内存和传输瓶颈。通过GPU虚拟和物理内存管理及多GPU、多路径和多任务优化,提高了硬件资源利用率,最高可将训练吞吐量提高4倍,推理内存降低3倍,IO传输加速3至12倍。GLake易于集成,无需代码修改,且提供内存优化、多路径IO传输提升、和数据去重等功能,为AI训练与推理提供高效、安全的解决方案。
nvtop - 多厂商GPU和加速器的实时性能监控工具
GPU监控GithubNVTOP任务管理器多GPU支持开源项目系统资源
NVTOP是一款开源的GPU和加速器监控工具,支持NVIDIA、AMD、Intel等多家厂商的硬件。它采用类似htop的界面,可实时监控多个GPU的性能指标。NVTOP提供交互式设置窗口用于界面自定义,支持保存用户偏好,并具备命令行选项。通过与各种驱动程序和接口集成,NVTOP能够获取详细的GPU信息,为用户呈现直观的硬件监控数据。
mig-parted - NVIDIA Ampere GPU分区管理工具
GithubMIGNVIDIA GPU分区编辑器开源项目系统管理配置管理
nvidia-mig-parted是一个开源的NVIDIA Ampere多实例GPU(MIG)分区管理工具。它支持系统管理员以声明式方式定义和应用多种MIG配置。通过命令行接口,管理员可以灵活地启用/禁用MIG、创建不同规格的MIG设备,并在集群中快速切换配置。这大大简化了GPU资源管理,提高了系统效率。
delta-sharing - 开放协议实现跨平台大规模数据实时共享
Delta SharingGithub云存储开放协议开源项目数据交换数据共享
Delta Sharing是一个开放协议,用于安全实时交换大型数据集。它支持跨平台实时数据共享,使用REST API安全共享云数据集,通过S3、ADLS或GCS等云存储系统传输数据。用户可直接使用pandas、Tableau、Apache Spark等工具访问共享数据,无需部署特定计算平台。该协议简化了数据提供和使用流程,使数据共享更加高效便捷。
kompute - 通用GPU计算框架,支持AMD、Qualcomm和NVIDIA显卡
GPU加速GithubKomputeLinux基金会Vulkan开源项目机器学习
快速、移动友好且异步的通用GPU计算框架,专为高级GPU加速优化。支持Python和C++并兼容Vulkan,适用于机器学习、移动开发和游戏开发。由Linux基金会支持,社区活跃,示例丰富。
nccl-rdma-sharp-plugins - NCCL插件,支持RDMA和SHARP的GPU通信优化工具
CUDAGithubMOFEDNCCLRDMASHARP开源项目
nccl-rdma-sharp-plugins是NVIDIA NCCL库的扩展插件,为GPU通信提供RDMA和SHARP支持。该项目依赖MOFED、CUDA等组件,使用GNU autotools进行构建。通过优化GPU间数据交换,该插件可提升分布式深度学习等场景的通信效率。项目开源,适合需要高性能GPU通信的开发者和研究人员使用。
Denvr Dataworks - 专业GPU云平台,加速AI训练与推理
AIAI工具Denvr CloudGPUNVIDIA云计算
Denvr Dataworks提供专为AI优化的云计算服务,包括高性能GPU资源、按需或专用超级计算能力,以及主流AI框架的一键部署。平台采用NVIDIA和Intel最新GPU架构,确保卓越性能和可扩展性。通过简化AI开发和运营流程,Denvr Dataworks为各类AI项目提供高效、灵活的云计算解决方案。
higgsfield - 高容错且可扩展的GPU调度与机器学习框架
GPU管理GithubHiggsfield分布式计算大模型训练开源项目深度学习
Higgsfield是一款开源、高容错、可扩展的GPU调度与机器学习框架,适用于数十亿到数万亿参数的模型(如大型语言模型)。它的主要功能包括分配计算资源、支持高效分片、启动和监控大规模神经网络训练、管理资源竞争,并通过与GitHub的集成实现持续集成。Higgsfield简化了大规模模型训练的流程,提供了多样且强大的开发工具。
tiny-gpu - 简化GPU实现深入解析并行计算原理
GPUGithub内存并行化开源项目指令集架构
tiny-gpu是一个精简的GPU实现项目,旨在帮助学习者理解GPU工作原理。该项目聚焦通用GPU和机器学习加速器的核心原理,包括架构设计、SIMD并行化和内存管理。通过Verilog实现、架构文档和矩阵运算示例,tiny-gpu简化了复杂概念,使学习者能从底层理解现代硬件加速器的关键要素。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号