watsor

实时视频流物体检测的开源项目

物体检测视频流实时监控 MQTT HomeAssistant Github 开源项目

Watsor是一个开源的视频监控项目,利用深度学习实现实时物体检测。它支持多种硬件加速器,通过MQTT协议报告检测结果,并可通过HTTP广播带检测结果的视频流。适用于CCTV等需要视频流物体检测的场景。主要功能包括智能检测、检测区域限制、硬件加速、MQTT集成和多格式视频编码。

文档

videollm-online - 流式视频实时理解与交互的先进模型

GithubVideoLLM-online大语言模型实时交互开源项目流媒体视频视频处理

VideoLLM-online是一款针对流媒体视频的在线大语言模型。该模型支持视频流实时交互，可主动更新响应，如记录活动变化和提供实时指导。项目通过创新的数据合成方法将离线注释转化为流式对话数据，并采用并行化推理技术实现高速处理，在A100 GPU上处理速度可达10-15 FPS。VideoLLM-online在在线和离线环境中均表现出色，能高效处理长达10分钟的视频，为视频理解与交互领域带来新的可能性。

WhatWaf - 先进的Web应用防火墙检测与绕过工具

GithubWeb应用防护WhatWaf开源项目渗透测试网络安全防火墙检测

WhatWaf是一款先进的Web应用防火墙(WAF)检测工具，能够识别86种不同类型的WAF，并尝试绕过已检测到的防火墙。该工具提供36种混淆脚本，可对有效载荷进行编码以实现绕过。WhatWaf支持多种输入方式，如单个URL、URL列表文件和Burp Suite请求文件等，同时提供丰富的自定义选项来控制请求行为和输出格式。此外，WhatWaf还具备自动更新、代理支持、多线程处理等功能，为Web应用安全测试提供了强大的支持。

minisora - 致力探索AI视频生成技术的开源社区

DiTGithubMiniSoraSora开源社区开源项目视频生成

MiniSora是一个社区驱动的开源项目，专注于探索AI视频生成技术Sora的实现路径。该项目组织定期圆桌讨论、深入研究视频生成技术、复现相关论文并进行技术回顾。MiniSora旨在开发GPU友好、训练高效、推理快速的AI视频生成方案，推动人工智能视频生成领域的开源发展。

pytracking - 基于PyTorch的开源视觉目标跟踪和视频对象分割框架

GithubPyTorch开源项目深度学习视觉目标跟踪视频目标分割计算机视觉

PyTracking是基于PyTorch的开源视觉目标跟踪和视频对象分割框架。它实现了多个先进的跟踪算法,如TaMOs、RTS和ToMP,并提供完整的训练代码和预训练模型。该框架包含用于实现和评估视觉跟踪器的库,涵盖常用数据集、性能分析脚本和通用构建模块。其LTR训练框架支持多种跟踪网络的训练,提供丰富的数据集和功能。

datmo - 2D激光雷达移动物体检测跟踪系统

GithubLIDAR开源项目数据关联机器人目标检测目标跟踪

datmo是一款为配备2D激光雷达的机器人平台设计的移动物体检测跟踪系统。它可准确估算矩形物体的位置、速度、方向和尺寸。系统使用自适应断点检测算法聚类，搜索式矩形拟合算法提取L形，并结合卡尔曼滤波器进行运动和形状跟踪。datmo兼容ROS，提供可视化功能，适用于自动驾驶和移动机器人领域的物体跟踪。

heartbeat - 基于视频分析的非接触式心率测量开源项目

Github人脸检测信号处理开源项目心率测量无接触监测远程光电容积脉搏波描记法

Heartbeat是一个利用远程光体积描记法(rPPG)进行心率测量的开源项目。该项目采用OpenCV库实现人脸检测和跟踪，通过频率分析和滤波技术估算心率。它通过分析面部视频中的细微肤色变化来实现非接触式心率监测。Heartbeat支持实时视频流分析和离线视频文件处理，并提供多种算法选项和可调参数。这一创新工具不仅适用于研究人员和开发者，还为远程健康监测和情感状态评估等领域提供了新的可能性，展示了计算机视觉技术在健康监测领域的巨大潜力。

WowTo - 智能视频知识库解决方案

AI工具AI视频创建WowTo客户支持支持视频视频知识库

WowTo提供智能视频知识库解决方案，包括AI驱动的视频创建工具、知识库构建和托管服务，以及嵌入式视频小部件。支持多语言本地化和客户支持应用集成，有助于提升客户满意度，减少支持工单和客户流失。该平台适用于制作操作指南、培训视频等多种场景，为企业提供全方位的视频支持服务。

VoTT - 开源图像与视频标注工具，兼容多种数据存储方式

GithubVoTT图像标注开源标注工具开源项目机器学习视频标注

VoTT是一个基于React和Redux的开源图像和视频标注工具，支持从本地或云存储导入数据，并将标注数据导出到不同的存储提供商。作为机器学习工作流中的工具，VoTT提供图像和视频帧的标签功能，采用现代开发框架TypeScript编写，并进行代码检查和单元测试。支持Azure Blob Storage、Bing Image Search等多种数据源，用户可通过浏览器使用Web版本。

WebcamGPT-Vision - 通过OpenAI GPT-4 Vision API实现实时图像分析的轻量应用

FlaskGithubOpenAI GPT-4 Vision APIWebcamGPT-Visionwebcam图像处理实时图像捕获开源项目

WebcamGPT-Vision是一款轻量级Web应用，利用OpenAI的GPT-4 Vision API实现实时图像处理，支持PHP、Node.js和Python/Flask三种版本，具备简洁直观的界面设计，能够从摄像头捕获图像并显示AI生成的描述。需要现代网络浏览器、相应的软件安装和OpenAI API密钥。

MVision - 前沿机器视觉与智能算法技术集合

GithubSLAM技术开源项目无人驾驶机器视觉深度学习计算机视觉

MVision专注于探索机器视觉与人工智能的前沿研究和应用。该平台涵盖自然语言处理、深度学习和计算机视觉课程等多个方面，提供如ICDM、NIPS等重要会议的资源链接和最新机器学习研究文献。同时，MVision也关注无人驾驶、动态物体检测等实际应用领域，致力于提供全面的学习和实践资源，以推动技术进步和行业发展。

相关项目

推荐项目

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

稿定AI

稿定设计是一个多功能的在线设计和创意平台，提供广泛的设计工具和资源，以满足不同用户的需求。从专业的图形设计师到普通用户，无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑，稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合，帮助用户轻松实现创意设计。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com