Project Icon

BackgroundMattingV2

实时高分辨率背景抠图技术的创新突破

该项目开发了实时高分辨率背景抠图技术,通过额外背景图像实现高质量抠图。研究展示了创新的神经网络架构,并提供新数据集。成果获CVPR 2021最佳学生论文荣誉提名,推动视频处理和图像编辑技术发展。

实时高分辨率背景抠图

预览图

这是论文 实时高分辨率背景抠图 的官方代码库。我们的模型需要额外捕捉一张背景图像,可以在 Nvidia RTX 2080 TI GPU 上以 4K 30fps 和 HD 60fps 的速度产生最先进的抠图结果。

免责声明:本仓库中的视频转换脚本并非实时。我们研究的主要贡献是用于高分辨率细化的神经网络架构和新的抠图数据集。inference_speed_test.py 脚本允许您测量我们模型的张量吞吐量,应该可以达到实时。inference_video.py 脚本允许您在我们的模型上测试视频,但视频编码和解码是在没有硬件加速和并行化的情况下完成的。对于生产用途,您需要进行额外的工程以实现硬件编码/解码并并行将帧加载到 GPU。有关架构详细信息,请参阅我们的论文。

 

新论文发布!

查看 稳健视频抠图! 我们的新方法不需要预先捕获背景,并且可以以更快的速度进行推理!

 

概述

 

更新

  • [2021年6月21日] 论文获得 CVPR 2021 最佳学生论文荣誉提名。
  • [2021年4月21日] VideoMatte240K 数据集现已发布。
  • [2021年3月6日] 训练脚本已发布。
  • [2021年2月28日] 论文被 CVPR 2021 接受。
  • [2021年1月9日] PhotoMatte85 数据集现已发布。
  • [2020年12月21日] 我们将项目更新为 MIT 许可证,允许商业使用。

 

下载

模型 / 权重

视频 / 图像示例

数据集

 

演示

脚本

我们在此仓库中提供了几个脚本,供您试验我们的模型。文件中包含更详细的说明。

  • inference_images.py: 对一个图像目录进行抠图。
  • inference_video.py: 对视频进行抠图。
  • inference_webcam.py: 使用您的网络摄像头进行交互式抠图演示。

笔记本

此外,您可以在 Google Colab 中尝试我们的笔记本,对图像和视频进行抠图。

虚拟摄像头

我们提供了一个演示应用程序,可以将网络摄像头视频通过我们的模型处理并输出到虚拟摄像头。该脚本仅适用于 Linux 系统,可以在 Zoom 会议中使用。更多信息,请查看:

 

使用 / 文档

您可以使用 PyTorchTorchScriptTensorFlowONNX 运行我们的模型。有关使用我们模型的详细信息,请查看 使用 / 文档 页面。

 

训练

配置 data_path.pth 以指向您的数据集。原始论文使用 train_base.pth 仅训练基础模型直至收敛,然后使用 train_refine.pth 对整个网络进行端到端训练。更多细节在论文中有指定。

 

项目成员

* 贡献相同。

 

许可证

本作品采用 MIT 许可证。如果您在项目中使用我们的工作,我们希望您能包含致谢并填写我们的 调查问卷

社区项目

由第三方开发者开发的项目。

项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能,包括文生视频、动态画面和形象生成等,帮助用户快速上手,创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台,用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品,帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型,为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能,满足事务性工作的高频需求,帮助撰稿人节省精力,提高效率,优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号