mlt

开源视频编辑多媒体框架

MLT是一个专为视频编辑设计的LGPL多媒体框架。该项目采用CMake进行配置和编译，便于开发者在系统中测试和安装。MLT提供了丰富的功能和灵活的接口，适用于各种视频编辑需求。项目官方网站包含详细文档和贡献指南，有助于开发者深入了解和参与项目。

访问官网

Github

文档

介绍相关项目

mmaction2 - 开源视频理解工具箱MMAction2基于PyTorch实现

GithubMMAction2OpenMMLab开源项目模型库行动识别视频理解

MMAction2为基于PyTorch的开源视频理解工具箱，涵盖动作识别、动作定位、时空动作检测等多种任务。项目特点包括模块化设计、丰富的模型库以及详尽文档，支持灵活的自定义配置。

videollm-online - 流式视频实时理解与交互的先进模型

GithubVideoLLM-online大语言模型实时交互开源项目流媒体视频视频处理

VideoLLM-online是一款针对流媒体视频的在线大语言模型。该模型支持视频流实时交互，可主动更新响应，如记录活动变化和提供实时指导。项目通过创新的数据合成方法将离线注释转化为流式对话数据，并采用并行化推理技术实现高速处理，在A100 GPU上处理速度可达10-15 FPS。VideoLLM-online在在线和离线环境中均表现出色，能高效处理长达10分钟的视频，为视频理解与交互领域带来新的可能性。

llvm-project - 开源编译器基础设施和工具链

ClangGithubLLVM中间表示代码优化开源项目编译器基础设施

LLVM是一个开源编译器基础设施项目，提供用于构建优化编译器和工具链的框架。核心组件包括LLVM后端、Clang前端、libc++标准库和LLD链接器。LLVM支持多种编程语言，提供中间表示处理和代码生成工具。项目致力于提高编译效率和代码性能，为开发者提供灵活的编译工具集。LLVM广泛应用于编译器开发、静态分析和运行时优化等领域。

score - 开源交互式音视频序列器软件

Githubossia score交互式编程多媒体创作开源软件开源项目音视频序列器

ossia score是一款开源的交互式音视频序列器软件，支持OSC、MIDI、DMX等多种协议。它允许创作者使用JavaScript、ISF着色器等进行脚本编程和实时编码，并可集成多种创意编程语言。该软件适用于桌面、移动和嵌入式平台，为音视频艺术家提供了创建交互式多媒体作品的工具。

wlmedia - 轻量级高性能Android音视频播放框架

AndroidGithubwlmedia多功能播放器多平台支持开源项目音视频播放SDK

wlmedia是一个开源的Android音视频播放框架，支持多种设备和系统。它提供简洁API，兼容多种音视频格式，具备AV1解码、透明视频播放、多实例播放等功能。此外，wlmedia还支持音视频加密、字幕选择和截屏等特性，适合开发多样化的音视频应用。该项目性能稳定，持续迭代更新，计划未来支持HarmonyOS和iOS平台。

vime - 多功能、跨平台的开源媒体播放器

GithubVimeWeb组件媒体播放器开源开源项目跨框架

Vime是一个开源的媒体播放器项目，支持HTML5、HLS、YouTube等多种媒体源。它提供统一API，确保跨浏览器兼容性，支持国际化和无障碍访问。Vime基于Web组件设计，易于定制和扩展，并提供主流前端框架的集成。其轻量级设计和丰富功能使其成为构建现代媒体播放器的有力工具。

openvidu - 开源实时视频通信解决方案

GithubOpenVidu实时通信开源项目社区支持视频会议

OpenVidu是一个开源视频通话解决方案，提供API用于集成实时视频通信功能。支持多种编程语言和框架，具备可扩展性和定制性。功能包括用户隐私保护、屏幕共享、录制和直播。提供Docker支持，拥有社区论坛和详细文档。适用于不同规模的项目开发。

video_editor - Flutter视频编辑库提供裁剪旋转和封面选择功能

FlutterGithub多媒体处理开源库开源项目移动应用开发视频编辑

video_editor是一个Flutter视频编辑库,支持视频裁剪、旋转、缩放和封面选择等功能。该库提供灵活的UI设计和导出工具,但不直接处理视频导出。目前仅支持iOS和Android平台,使用Dart编写。它包含VideoEditorController用于控制编辑,以及用于裁剪、修剪和封面选择的组件。开发者可自定义界面样式,并通过FFmpeg配置进行视频导出。

audapolis - 多媒体编辑器提供文字处理器式体验

Githubaudapolis媒体编辑开源软件开源项目文字转录音频编辑器

audapolis是一款开源的多媒体编辑工具，为口语媒体编辑提供类似文字处理器的操作体验。该工具支持音频自动转录为文本，适用于视频、音频和混合编辑，可用于制作广播节目、播客、有声书和采访片段等内容。audapolis重视用户隐私，采用本地存储方式，无需云端服务。该软件支持Windows、Linux和macOS平台，致力于简化媒体编辑工作流程。

Gen-L-Video - 无需额外训练实现多文本条件长视频生成和编辑

Gen-L-VideoGithub多文本条件开源项目无需预训练视频编辑长视频生成

Gen-L-Video是一种扩展短视频扩散模型的视频生成方法,能实现多文本条件下的长视频生成和编辑。该方法无需额外训练即可处理数百帧的视频,并保持内容一致性。Gen-L-Video支持多语义段视频生成、平滑语义变化和视频内容编辑等功能,为长视频处理提供了一种通用解决方案。

相关项目

推荐项目

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com