channel-pruning

通道剪枝技术加速深度神经网络

Channel Pruning 神经网络加速模型压缩深度学习计算机视觉 Github 开源项目

Channel Pruning 项目开发了一种通道剪枝技术，用于加速深度神经网络。该技术显著提高了 VGG-16、ResNet-50 等模型的推理速度，同时保持了较高准确率。项目还包含针对 Faster R-CNN 的剪枝方法，为计算机视觉任务提供了高效解决方案。具体实现了 VGG-16 模型 4 倍和 5 倍的加速，ResNet-50 模型 2 倍加速，以及 Faster R-CNN 2 倍和 4 倍加速。这些优化后的模型在 ImageNet 分类和目标检测任务上仍保持了较高性能。项目提供了代码和预训练模型，方便研究者复现实验结果。

访问官网

Github

介绍相关项目

caffe - 一个用于深度学习的快速开放框架

BAIRBVLCCaffeGithub开源项目模型动物园深度学习框架

Caffe是由伯克利AI研究中心和社区贡献者开发的深度学习框架，强调高效表达、速度和模块化。用户可以通过项目网站获取详细信息，包括DIY深度学习教程、文档、参考模型和社区模型库。Caffe提供多种自定义版本，例如优化CPU和多节点支持的Intel Caffe、适用于AMD和Intel设备的OpenCL Caffe，以及Windows Caffe。社区用户可通过Gitter聊天和Google论坛进行交流，提交问题和建议。项目遵循BSD 2-Clause许可证，鼓励在研究中引用。

V-Express - 渐进式训练提升肖像视频生成质量

GithubV-Express开源项目控制信号平衡条件性丢弃渐进式训练肖像视频生成

V-Express项目提出条件性丢弃新方法,实现肖像视频生成的渐进式训练。该方法平衡不同控制信号强度,增强音频等弱信号作用,同时考虑姿态、图像和音频,生成高质量肖像视频。项目优化内存使用,支持长视频生成,提供多种重定向策略,适用不同场景。开源代码和模型可供学术及商业用途,但使用时需遵守相关法规。

DN-DETR - 创新查询去噪技术加速目标检测训练

DETRGithub开源项目注意力机制深度学习目标检测计算机视觉

DN-DETR通过创新的查询去噪技术加速DETR目标检测模型训练。该方法仅需50%训练周期即可达到基线模型性能,大幅提高训练效率。项目开源了DN-DETR、DN-Deformable-DETR等多个模型实现,并提供详细的模型库、使用指南和安装说明,便于研究者复现结果或将去噪训练应用于其他模型。

InternImage - 突破大规模视觉基础模型性能极限

GithubInternImage图像分类大规模视觉模型开源项目目标检测语义分割

InternImage是一款采用可变形卷积技术的大规模视觉基础模型。它在ImageNet分类任务上实现90.1%的Top1准确率,创下开源模型新纪录。在COCO目标检测基准测试中,InternImage达到65.5 mAP,成为唯一突破65.0 mAP的模型。此外,该模型在涵盖分类、检测和分割等任务的16个重要视觉基准数据集上均展现出卓越性能,树立了多个领域的新标杆。

algebraic-nnhw - 创新FFIP算法驱动的机器学习硬件加速器

GithubML硬件架构SystemVerilog内积算法开源项目深度神经网络加速器系统架构

项目开发的机器学习硬件加速器架构采用了创新的Free-pipeline Fast Inner Product (FFIP)算法。这种设计只需要传统方法一半的乘法器单元，就能实现相同的性能。该架构适用范围广泛，涵盖全连接、卷积、循环和注意力/transformer等多种机器学习模型层。它可以轻松集成到现有的定点系统阵列ML加速器中，显著提升吞吐量和计算效率。项目不仅提供了完整的RTL实现，还包括配套的编译器和测试环境，为机器学习硬件加速研究领域贡献了有价值的资源。

speculative-decoding - 推测解码技术，优化大型语言模型推理速度

GithubSpeculative Decoding大语言模型开源项目性能优化推理加速自然语言处理

该开源项目聚焦于推测解码技术的研究与实现，旨在提升大型语言模型的文本生成效率。项目涵盖了多种推测解码策略，包括提前退出、推测采样和先知变压器。同时，项目致力于优化批处理推测解码，以增强整体性能。研究计划还包括对比不同策略的效果，并探索微观优化方法。这些工作为加快AI模型推理速度提供了新的技术思路。

SRe2L - 创新的ImageNet规模数据集压缩技术

GithubImageNetNeurIPS大规模数据开源项目数据集蒸馏自监督压缩

SRe2L项目提出了一种新颖的大规模数据集压缩方法，通过'挤压'、'恢复'和'重新标记'三个步骤实现ImageNet规模数据的高效压缩。该方法在NeurIPS 2023会议上获得spotlight展示，为数据集蒸馏领域带来新的研究视角。项目还包括SCDD和CDA等相关工作，共同推动数据集蒸馏技术在大数据时代的应用和发展。

distill-sd - 更小更快速的Stable Diffusion模型，依靠知识蒸馏实现高质量图像生成

GithubStable Diffusion开源项目模型压缩神经网络训练细节预训练检查点

基于知识蒸馏技术开发的小型高速Stable Diffusion模型。这些模型保留了完整版本的图像质量，同时大幅减小了体积和提升了速度。文档详细介绍了数据下载脚本、U-net训练方法和模型参数设置，还支持LoRA训练及从检查点恢复。提供清晰的使用指南和预训练模型，适配快速高效图像生成需求。

DenseCL - 改进密集预测任务的视觉预训练方法

DenseCLGithub密集预测对比学习开源项目自监督学习视觉预训练

DenseCL是一种自监督视觉预训练方法，通过密集对比学习提升模型在密集预测任务中的表现。该方法实现简洁，核心部分仅需10行代码，适配多种数据增强技术。实验表明，DenseCL在目标检测和语义分割任务中性能显著提升，同时保持训练效率。项目开源了预训练模型和使用指南，便于研究者在视觉任务中应用。

awesome-efficient-aigc - AIGC效率优化技术与资源汇总

AIGCGithubLLM开源项目模型压缩量化高效推理

该项目汇集了提高AI生成内容(AIGC)效率的最新技术资源，包括大语言模型(LLMs)和扩散模型(DMs)的优化方法。收录内容涵盖前沿研究论文、代码实现和综述文章，重点关注量化、微调等效率提升技术。这一持续更新的资源库为AIGC领域的研究和开发提供了全面的参考，有助于推动相关技术的进步与落地应用。

相关项目

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计是一个多功能的在线设计和创意平台，提供广泛的设计工具和资源，以满足不同用户的需求。从专业的图形设计师到普通用户，无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑，稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合，帮助用户轻松实现创意设计。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号