Project Icon

lectures

GPU并行计算技术与高性能编程系列讲座

讲座系列涉及CUDA、PyTorch优化、量化技术和稀疏计算等GPU编程前沿话题。由行业专家授课,内容包括性能分析、内存架构和优化方法。结合理论和实践,帮助学习者掌握并行计算技能,增强GPU编程水平。面向对GPU加速和深度学习优化感兴趣的技术人员。

intel-extension-for-pytorch - 通过最新优化提升Intel硬件的深度学习性能
AIGPUsGithubIntel® Extension for PyTorchLLMs优化开源项目
Intel® Extension for PyTorch* 提供优化功能,利用Intel® AVX-512 VNNI、AMX以及XMX AI引擎,提升Intel CPU和GPU上的深度学习性能。该扩展优化了大规模语言模型(LLMs),如LLAMA、GPT-J、GPT-NEOX等,支持多种量化方法(如FP32、BF16、INT8、INT4)。此外,自2.3.0版本起,还引入了模块级优化API,为定制模型优化提供了更多选项。
LLM-Training-Puzzles - 大型语言模型训练中的内存效率与计算管道优化
AIGPUGithubLLM Training Puzzles内存效率开源项目计算流水线
本项目包含8个在多GPU环境下训练大型语言模型的挑战性谜题,旨在通过实践掌握内存效率和计算管道优化的关键训练原理。尽管大多数人没有机会在成千上万台计算机上进行训练,这些技能对现代AI的发展至关重要。推荐使用Colab运行这些谜题,提供便捷的上手体验。
Daily-DeepLearning - 全面计算机基础、Python应用、数据科学及机器学习指南
GithubPython开源项目操作系统数据结构机器学习深度学习
提供丰富的计算机科学教育资源,涵盖数据结构、操作系统、计算机网络等基础课程。Python和数据科学部分包括numpy、pandas、matplotlib等流行库的使用教程。机器学习和深度学习部分涉及逻辑回归、集成学习、RNN、CNN等理论及实践内容,适合初学者及进阶学习者掌握计算机科学与人工智能技术。
TensorRT_Tutorial - 深度学习推理加速实践指南
GPU加速GithubINT8量化TensorRT开源项目性能优化深度学习
TensorRT_Tutorial项目是一个综合性资源库,提供NVIDIA TensorRT深度学习推理加速的实用指南。项目包含中文文档翻译、视频教程、博客文章和代码示例,覆盖TensorRT的基础使用和高级优化。内容涉及核心功能介绍、实际应用经验和优化技巧,为深度学习从业者提升模型推理性能提供了宝贵参考。
ZLUDA - 英特尔GPU上的高性能CUDA兼容层
CUDAGithubIntel GPUZLUDA开源项目性能替代方案
ZLUDA项目为英特尔GPU提供CUDA兼容层,使未修改的CUDA应用能在英特尔显卡上运行。它支持英特尔UHD集成显卡和即将推出的Xe系列GPU。作为概念验证,ZLUDA目前主要适用于GeekBench等程序,性能与OpenCL代码相近。该项目无需代码移植即可使现有应用在英特尔GPU上运行,但目前仍处于早期开发阶段。
lectures - Oxford Deep NLP 2017 课程
DeepMindGithub开源项目神经网络自然语言处理语言模型递归神经网络
探索学习和实践递归神经网络在自然语言处理中的应用,包括语言模型、文本翻译、语音转录及问答系统等。
DeepLearningProject - 全面教程涵盖数据集创建与深度学习
GithubHarvard UniversityPyTorchPython开源项目机器学习深度学习
本教程详细介绍了从创建自定义数据集到应用传统和深度学习算法的完整机器学习管道。基于哈佛大学高级数据科学课程项目,内容更新为PyTorch版本,适合希望深入理解和实践机器学习的用户。
gpu.cpp - 简化跨平台GPU计算的轻量级库
C++库GPU计算GithubWGSLWebGPU开源项目跨平台
gpu.cpp是一个轻量级C++库,专注于通用原生GPU计算。它利用WebGPU规范作为可移植的低级GPU接口,支持在多种硬件上运行GPU代码。该库提供高效API,实现快速编译和运行周期,并最小化依赖。适用于GPU算法开发、神经网络实现、物理模拟等需要便携GPU计算的项目。gpu.cpp简化了个人设备上的GPU编程,让开发者能专注于算法实现。
exploring-AI-optimization - 人工智能模型优化技术的精选学习资源
AI优化Github剪枝开源项目深度学习编译器蒸馏量化
Exploring AI optimization项目是一个聚焦AI优化技术的资源库,收录了量化、剪枝等领域的高质量论文、教程和课程。该项目每周更新AI优化领域的重要研究见解,为研究人员和开发者提供学习参考,推动AI技术发展。资源库开放社区贡献,鼓励知识交流与分享。
nccl - 优化GPU间通信的高性能库
GPU通信GithubNCCLNVIDIA并行计算开源项目深度学习
NCCL是NVIDIA开发的开源GPU通信库,为深度学习和高性能计算优化了全归约、广播等通信模式。它在PCIe、NVLink等平台上实现高带宽,支持单节点和多节点GPU应用。NCCL可用于任意数量的GPU,适配单进程和多进程(如MPI)环境,为AI和科学计算提供高效的通信解决方案。该项目提供简易的构建安装方法和灵活的编译选项,方便开发者根据需求优化性能。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号