virtual-background

浏览器内实时视频流虚拟背景替换，支持多个机器学习模型

Virtual Background BodyPix MediaPipe ML Kit WebAssembly Github 开源项目

该项目展示了如何在浏览器实时视频流中，添加虚拟背景并切换三种预训练机器学习模型，包括BodyPix、MediaPipe Meet Segmentation和ML Kit Selfie Segmentation。用户可以对桌面和移动设备上的不同模型性能进行比较。此项目提供了详细的实现细节、性能分析及改进建议。

访问官网

Github

介绍相关项目

faceswap - 面部识别与交换工具，支持图片和视频处理

AI换脸FaceSwapGithub人脸识别开源项目深度学习视频处理

FaceSwap是一款深度学习驱动的面部识别和交换工具，适用于图片和视频。该项目支持Windows、Linux和MacOS操作系统，通过提取、训练和转换步骤实现面部交换，并支持GPU加速处理。FaceSwap提供详细的安装和使用指南，并拥有活跃的社区支持，包括Discord服务器和专门论坛。项目遵循严格的道德标准，倡导合理合法的使用，致力于推动AI技术的学习与应用。

awesome-virtual-try-on - 虚拟试衣研究的综合资源汇总

Github人工智能图像生成开源项目深度学习虚拟试衣计算机视觉

该项目整理了虚拟试衣(VTON)领域的研究资源,包括最新论文、代码、数据集和演示。内容涵盖基于提示、2D/3D图像、混搭、野外场景和多姿态引导等多个研究方向,并提供相关会议workshop信息。为虚拟试衣技术的研究人员和开发者提供全面的参考资料。

semana-javascript-expert08 - 浏览器端视频处理与转换系统

GithubJavaScriptWeb WorkersWebMcanvas开源项目视频处理

这是一个浏览器端视频处理系统，支持MP4格式视频处理、多线程转换、实时帧渲染和WebM格式生成。项目提供了多样化的功能实现和扩展任务，包括视频分辨率转换、音频处理等，适合想要提升JavaScript和视频处理技能的开发者学习和实践。

vid2avatar - 自监督场景分解实现野外视频3D人物重建

3D头像重建GithubVid2Avatar场景分解开源项目自监督学习视频处理

Vid2Avatar是一个开源项目，采用自监督场景分解方法从未处理的野外视频中重建3D人物模型。该方法无需额外监督，通过分离人物和背景实现精确建模。项目包含完整代码、预处理数据集和使用说明，适用于复杂场景的人物建模。

Human-Video-Generation - 人工智能视频生成技术的演进与应用

3D建模Github人体视频生成人工智能开源项目深度学习计算机视觉

Human-Video-Generation项目收录了2018年以来人工智能视频生成领域的重要研究成果。该项目涵盖面部重演、动作迁移和语音驱动动画等多个方向，提供了前沿论文、代码实现和演示视频。从早期的PSGAN到最新的Real3D-Portrait，项目全面展示了AI视频生成技术的快速进展，为相关领域的研究者和开发者提供了丰富的参考资源。

photo-background-generation - 基于文本引导的扩散模型实现对象背景一致性

GithubHuggingfaceSalient Object-Aware Background Generation开源项目文本指导扩散模型模型物体膨胀电子商务广告背景生成

该开源项目通过文本引导的扩散模型，解决显著对象背景生成中的'对象扩展'问题，保持对象身份和背景的一致性。适合商业广告等需要清晰度的场景。项目已被CVPR 2024采用，提供创新的背景生成方法。

videollm-online - 流式视频实时理解与交互的先进模型

GithubVideoLLM-online大语言模型实时交互开源项目流媒体视频视频处理

VideoLLM-online是一款针对流媒体视频的在线大语言模型。该模型支持视频流实时交互，可主动更新响应，如记录活动变化和提供实时指导。项目通过创新的数据合成方法将离线注释转化为流式对话数据，并采用并行化推理技术实现高速处理，在A100 GPU上处理速度可达10-15 FPS。VideoLLM-online在在线和离线环境中均表现出色，能高效处理长达10分钟的视频，为视频理解与交互领域带来新的可能性。

slimsam-77-uniform - Transformers.js中的ONNX模型兼容性和遮罩生成

GithubHuggingfaceJavaScript库ONNXTransformers.jsmask生成web应用开源项目模型

该开源项目利用ONNX权重，使Transformers.js库兼容，实现AI模型在网页上的遮罩生成。允许通过JavaScript轻松进行图像处理，支持从模型中加载图像和处理器，使用2D定位点生成遮罩并计算IoU分数。项目提供在线演示，方便用户体验实时图像分割，建议将模型转换为ONNX格式以便于网页使用。

depthai - 深度学习与视频录制的多功能演示应用

DepthAIDockerGithubLuxonisPython依赖安装开源项目

这个项目提供了一个多功能的深度学习API演示程序，支持加载多种神经网络、创建管道和录制视频等功能。附有详细的安装指南和多种使用案例（包括QT GUI界面和命令行模式），用户能够轻松上手和测试DepthAI的功能。项目还支持多种AI模型，并可通过Docker运行，适用于开发者和机器学习爱好者。

VirtualMotionCapture - VR动作捕捉应用实现3D模型实时控制

GithubVRM模型VR游戏VirtualMotionCapture动作捕捉开源项目虚拟摄像机

VirtualMotionCapture是一款VR动作捕捉应用，可在VR游戏中实时控制3D模型。支持3-10点全身追踪，无需额外设备即可展示动态姿势。兼容VRM模型文件，可与VR游戏同时运行。支持多种追踪配置，包括HMD、手柄和多个追踪器。提供设备分配、相机控制和快捷键设置功能，适用于多种VR设备。

相关项目

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号