Project Icon

ComfyUI-YoloWorld-EfficientSAM

YOLO-World + EfficientSAM for ComfyUI 的非官方实现,提供高效的对象检测与实例分割功能

该项目非官方实现了YOLO-World和EfficientSAM,通过融合这两个模型,提供高效的对象检测与实例分割功能。版本V2.0新增了蒙版分离与提取功能,支持指定蒙版单独输出,可处理图像和视频。项目特点包括支持加载多种YOLO-World和EfficientSAM模型,提供检测框厚度、置信度阈值、IoU阈值等配置选项,以提升检测与分割的精准性。详细的视频演示和安装指南,使用户能够轻松上手,体验高效的图像处理能力。

ComfyUI_TensorRT - 利用TensorRT优化稳定扩散模型在NVIDIA RTX显卡上的性能
AI模型优化ComfyUIGithubNVIDIA GPUTensorRT开源项目稳定扩散
ComfyUI_TensorRT项目为ComfyUI提供了TensorRT节点,旨在优化NVIDIA RTX显卡上稳定扩散模型的性能。该项目支持多个版本的稳定扩散模型,包括SDXL、SVD和AuraFlow等。通过生成GPU专用的TensorRT引擎,实现了模型运行效率的显著提升。项目支持动态和静态引擎构建,适应不同的分辨率和批量大小需求。此外,项目还提供了详细的安装和使用指南,便于用户在ComfyUI中集成和应用。
yoloair2 - 多模型集成的YOLO目标检测工具库
GithubPyTorchYOLOAir2YOLO系列开源项目模型改进目标检测
YOLOAir2是一个基于PyTorch的YOLO系列算法工具库,集成了YOLOv7、YOLOv5等多种YOLO变体。它统一了模型代码框架和应用方式,支持用户自由组合backbone、neck和head模块,以构建定制化的目标检测网络。除目标检测外,该项目还整合了实例分割、图像分类等相关任务,为计算机视觉研究提供了便利的实验平台。
ComfyUI-Custom-Scripts - ComfyUI扩展脚本集合 提升AI图像生成效率
AI绘图ComfyUIGithub工作流开源项目自定义脚本节点编辑
ComfyUI-Custom-Scripts是一个功能丰富的扩展脚本集合,为ComfyUI提供多项实用功能。它包括自动完成、图表自动排列、节点锁定等工具,提升了ComfyUI的使用体验。此外,该项目还引入图像预览、数学表达式和声音提醒等创新功能,为AI图像生成工作流程带来更多灵活性和效率。
EVF-SAM - 基于早期视觉语言融合的文本引导图像分割模型
EVF-SAMGithubSAM模型图像分割开源项目视觉语言融合语义分割
EVF-SAM项目通过早期视觉语言融合技术扩展了SAM模型的能力,实现高精度的文本引导图像分割。该模型在T4 GPU上可在几秒内完成推理,计算效率高。最新版本基于SAM-2支持视频分割,展现了零样本文本引导视频分割能力。EVF-SAM在多个数据集上表现出色,为计算机视觉领域提供了新的解决方案。
ComfyUI_VisualStylePrompting - ComfyUI视觉风格提示工具 优化AI图像生成
ComfyUIGithub参考图像工作流开源项目自注意力交换视觉风格提示
ComfyUI_VisualStylePrompting是ComfyUI的一个扩展工具,实现了Visual Style Prompting技术。该工具通过交换自注意力机制,从参考图像中提取视觉风格并应用到新生成的图像中。它提供多项可调参数,包括去噪、输入块、中间块和输出块设置,用于精细控制风格转移过程。这个工具主要适用于1.5基础模型,可以提高AI生成图像的质量和风格一致性。
segment-anything-2 - 新一代图像和视频分割基础模型
AI模型GithubSAM 2图像分割开源项目视频分割计算机视觉
SAM 2是Meta AI研发的图像和视频分割基础模型,扩展了SAM的功能。它采用transformer架构和流式内存,实现实时视频处理。通过模型循环数据引擎,研究团队构建了大规模视频分割数据集SA-V。SAM 2在多种视觉任务中展现出卓越性能,为计算机视觉领域带来新的可能。
yolor - 改进的多任务统一网络实时对象检测模型
GithubYOLORYOLOv4多任务学习对象检测开源项目深度学习
该项目实现了一个新型多任务统一网络,基于最新论文支持多任务并在COCO数据集中的实时对象检测上表现出色。优化后的YOLOR模型在测试和验证中均显示出较高的AP值和运行速度,适用于多种实时应用场景。项目提供了详细的安装、训练和测试指南,支持Docker和Colab环境,适合研究人员和开发者在复杂场景中进行高效的对象检测。
comfyui-tooling-nodes - ComfyUI外部工具节点集合,扩展图像处理和API功能
AI工具ComfyUIGithub图像处理开源项目深度学习节点系统
comfyui-tooling-nodes为ComfyUI提供了一系列增强功能的节点集合。这些节点涵盖了图像处理、区域注意力遮罩和平铺图像处理等功能,同时还包含HTTP API扩展。该项目将ComfyUI定位为外部工具的后端,通过base64图像传输、WebSocket通信和多语言翻译等功能,有效提升了工作流程的效率和灵活性。这些功能为开发者和用户开启了更多创新的可能性。
ComfyUI-BRIA_AI-RMBG - BRIA Background Removal v1.4的非官方实现,支持批量处理和视频背景去除
BRIA Background RemovalComfyUIGithubRMBG开源模型开源项目批量处理
ComfyUI-BRIA_AI-RMBG是BRIA Background Removal v1.4的非官方实现,支持批量处理和视频背景去除。最新版本V1.5新增输出mask功能,并能与ComfyUI无缝集成,简化视频处理工作,显著提升效率。通过简便的安装步骤即可快速上手,适用于多种视频编辑任务。
yolov10x - 高效的实时端到端物体检测工具
GithubHuggingfacePyTorchYOLOv10对象检测开源项目模型深度学习计算机视觉
YOLOv10是一个高效的端到端物体检测开源项目,支持在COCO等数据集上进行准确的训练和验证。通过整合PyTorch模型资源,用户可简便地安装和应用。本项目支持从预训练模型进行迁移学习,适合多种计算机视觉应用需求,是追求速度与精度的理想选择。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号