Project Icon

VanillaNet

高效简约的深度学习神经网络架构

VanillaNet是一种创新的神经网络架构,专注于简洁性和效率。它摒弃了复杂的快捷连接和注意力机制,仅使用较少的层数就能保持出色的性能。该项目展示了精简架构也能实现有效结果,为计算机视觉领域开辟了新路径,挑战了基础模型的现状。与主流模型相比,VanillaNet在保持相当性能的同时,具有更少的层数和更快的推理速度。

LeYOLO - 可扩展高效的目标检测CNN架构
COCO数据集GithubLeYOLO开源项目目标检测神经网络计算效率
LeYOLO是一种新型目标检测模型系列,通过创新的CNN架构设计实现了计算效率与准确性的优化平衡。该模型引入高效主干网络缩放、快速金字塔架构网络和解耦网络中的网络检测头,大幅降低计算负载。在COCO验证集上,LeYOLO-Small仅使用4.5 GFLOP就达到38.2%的mAP,比YOLOv9-Tiny减少42%计算量。LeYOLO系列具有强大可扩展性,适用于从超低计算需求(<1 GFLOP)到高效高性能(>4 GFLOPs)的多种场景。
Awesome-Deep-Neural-Network-Compression - 深度神经网络压缩技术资源库
GithubNAS剪枝开源项目模型优化深度神经网络压缩知识蒸馏量化
该项目汇集了深度神经网络压缩的综合资源,包括量化、剪枝和蒸馏等技术的论文、总结和代码。涵盖高效模型设计、神经架构搜索等相关主题,并提供按会议和年份分类的论文列表。项目还收录了主流压缩系统和工具链接,为深度学习模型压缩研究提供了全面的参考资料。
neural-compressor - 开源深度学习模型压缩工具库
GithubIntel Neural Compressor大语言模型开源项目模型压缩深度学习框架量化
Neural Compressor是一款开源深度学习模型压缩工具库,支持TensorFlow、PyTorch和ONNX Runtime等主流框架。它提供量化、剪枝、知识蒸馏等多种压缩技术,适用于Intel等多种硬件平台。该工具支持大语言模型优化,并与主流云服务和AI生态系统集成。其自动化的精度感知量化策略有助于平衡模型性能和精度。
sparsezoo - 高效稀疏神经网络模型库
GithubNeuralmagicSparseZoo开源项目模型库深度学习稀疏化模型
SparseZoo是一个不断扩展的神经网络模型库,包含高度稀疏和稀疏量化模型,以及相应的稀疏化配方。它简化并加速深度学习模型的开发,帮助实现高效推理。用户可以通过API或云端访问这些模型及其配方,并进行迁移学习或配方迁移。SparseZoo支持多种稀疏化算法和不同推理性能的模型,并提供全面的文档和社区支持。
facenet - 基于TensorFlow的高精度面部识别开源项目
FaceNetGithubInception ResNet v1TensorFlow人脸识别开源项目预训练模型
FaceNet,一个基于TensorFlow的开源面部识别项目,采用最新的深度学习技术和数据集(如CASIA-WebFace和VGGFace2)开发。其准确率可达99.65%,并使用MTCNN进行高效的面部对齐。适合需求高级面部识别技术的开发者和科研人员。
TopoNet - 自动驾驶场景拓扑推理的图神经网络方法
GithubOpenLane-V2TopoNet图神经网络场景拓扑推理开源项目自动驾驶
TopoNet是一个端到端框架,用于推理自动驾驶场景中车道中心线和交通元素间的连接关系。该框架采用图神经网络和知识图结构,整合异构特征并加强特征交互。TopoNet在OpenLane-V2数据集上展现了领先性能,为自动驾驶场景拓扑推理树立新标准。项目提供开源代码和预训练模型,促进自动驾驶研究发展。
CatVTON - 高效轻量的虚拟试衣扩散模型
CatVTONGithub参数高效训练开源项目扩散模型简化推理虚拟试衣
CatVTON是一个高效的虚拟试衣扩散模型,采用轻量级网络结构和参数高效训练方法。该模型总参数量为899.06M,其中可训练参数仅49.57M,在1024x768分辨率下推理时显存占用不到8G。项目开源了完整代码、预训练权重,并提供在线演示。CatVTON支持ComfyUI和Gradio部署,在VITON-HD和DressCode数据集上展现出优异性能,推动了虚拟试衣技术的发展。
wenet - 轻量精准的全栈语音识别解决方案
GithubWeNet安装指南开源工具包开源项目文档语音识别
WeNet项目提供生产就绪的全栈语音识别方案,强调精准与轻量化。项目在多个公共语音数据集上实现了最先进效果。WeNet易于安装和使用,支持Python编程和命令行操作,并兼容多种硬件,包括Ascend NPU。通过借鉴ESPnet和Kaldi等项目,WeNet提供高效的模型训练和部署方式。用户可在GitHub或微信讨论群中参与交流,获取技术支持和项目信息更新。
efficientvit - EfficientViT多尺度线性注意力用于高分辨率密集预测
EfficientViTGithub图像分割开源项目模型优化深度学习计算机视觉
EfficientViT是一种新型ViT模型,专注于高效处理高分辨率密集预测视觉任务。其核心是轻量级多尺度线性注意力模块,通过硬件友好操作实现全局感受野和多尺度学习。该项目提供图像分类、语义分割和SAM等应用的预训练模型,在性能和效率间达到平衡,适合GPU部署和TensorRT优化。
Papers-in-100-Lines-of-Code - 45篇深度学习论文的100行代码实现集锦
GithubNeRF开源项目机器学习深度学习神经网络计算机视觉
Papers-in-100-Lines-of-Code项目汇集了45篇深度学习领域重要论文的精简实现。覆盖范围广泛,从经典网络架构到前沿神经渲染技术,每个算法都浓缩为100行以内的代码。这种简洁实现有助于理解算法核心思想,为研究者和开发者提供了快速上手的机会。项目既展示了复杂算法的精髓,又为深度学习实践提供了便捷途径。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号