Project Icon

mlt

开源视频编辑多媒体框架

MLT是一个专为视频编辑设计的LGPL多媒体框架。该项目采用CMake进行配置和编译,便于开发者在系统中测试和安装。MLT提供了丰富的功能和灵活的接口,适用于各种视频编辑需求。项目官方网站包含详细文档和贡献指南,有助于开发者深入了解和参与项目。

mmaction2 - 开源视频理解工具箱MMAction2基于PyTorch实现
GithubMMAction2OpenMMLab开源项目模型库行动识别视频理解
MMAction2为基于PyTorch的开源视频理解工具箱,涵盖动作识别、动作定位、时空动作检测等多种任务。项目特点包括模块化设计、丰富的模型库以及详尽文档,支持灵活的自定义配置。
videollm-online - 流式视频实时理解与交互的先进模型
GithubVideoLLM-online大语言模型实时交互开源项目流媒体视频视频处理
VideoLLM-online是一款针对流媒体视频的在线大语言模型。该模型支持视频流实时交互,可主动更新响应,如记录活动变化和提供实时指导。项目通过创新的数据合成方法将离线注释转化为流式对话数据,并采用并行化推理技术实现高速处理,在A100 GPU上处理速度可达10-15 FPS。VideoLLM-online在在线和离线环境中均表现出色,能高效处理长达10分钟的视频,为视频理解与交互领域带来新的可能性。
llvm-project - 开源编译器基础设施和工具链
ClangGithubLLVM中间表示代码优化开源项目编译器基础设施
LLVM是一个开源编译器基础设施项目,提供用于构建优化编译器和工具链的框架。核心组件包括LLVM后端、Clang前端、libc++标准库和LLD链接器。LLVM支持多种编程语言,提供中间表示处理和代码生成工具。项目致力于提高编译效率和代码性能,为开发者提供灵活的编译工具集。LLVM广泛应用于编译器开发、静态分析和运行时优化等领域。
score - 开源交互式音视频序列器软件
Githubossia score交互式编程多媒体创作开源软件开源项目音视频序列器
ossia score是一款开源的交互式音视频序列器软件,支持OSC、MIDI、DMX等多种协议。它允许创作者使用JavaScript、ISF着色器等进行脚本编程和实时编码,并可集成多种创意编程语言。该软件适用于桌面、移动和嵌入式平台,为音视频艺术家提供了创建交互式多媒体作品的工具。
wlmedia - 轻量级高性能Android音视频播放框架
AndroidGithubwlmedia多功能播放器多平台支持开源项目音视频播放SDK
wlmedia是一个开源的Android音视频播放框架,支持多种设备和系统。它提供简洁API,兼容多种音视频格式,具备AV1解码、透明视频播放、多实例播放等功能。此外,wlmedia还支持音视频加密、字幕选择和截屏等特性,适合开发多样化的音视频应用。该项目性能稳定,持续迭代更新,计划未来支持HarmonyOS和iOS平台。
vime - 多功能、跨平台的开源媒体播放器
GithubVimeWeb组件媒体播放器开源开源项目跨框架
Vime是一个开源的媒体播放器项目,支持HTML5、HLS、YouTube等多种媒体源。它提供统一API,确保跨浏览器兼容性,支持国际化和无障碍访问。Vime基于Web组件设计,易于定制和扩展,并提供主流前端框架的集成。其轻量级设计和丰富功能使其成为构建现代媒体播放器的有力工具。
openvidu - 开源实时视频通信解决方案
GithubOpenVidu实时通信开源项目社区支持视频会议
OpenVidu是一个开源视频通话解决方案,提供API用于集成实时视频通信功能。支持多种编程语言和框架,具备可扩展性和定制性。功能包括用户隐私保护、屏幕共享、录制和直播。提供Docker支持,拥有社区论坛和详细文档。适用于不同规模的项目开发。
video_editor - Flutter视频编辑库 提供裁剪旋转和封面选择功能
FlutterGithub多媒体处理开源库开源项目移动应用开发视频编辑
video_editor是一个Flutter视频编辑库,支持视频裁剪、旋转、缩放和封面选择等功能。该库提供灵活的UI设计和导出工具,但不直接处理视频导出。目前仅支持iOS和Android平台,使用Dart编写。它包含VideoEditorController用于控制编辑,以及用于裁剪、修剪和封面选择的组件。开发者可自定义界面样式,并通过FFmpeg配置进行视频导出。
audapolis - 多媒体编辑器提供文字处理器式体验
Githubaudapolis媒体编辑开源软件开源项目文字转录音频编辑器
audapolis是一款开源的多媒体编辑工具,为口语媒体编辑提供类似文字处理器的操作体验。该工具支持音频自动转录为文本,适用于视频、音频和混合编辑,可用于制作广播节目、播客、有声书和采访片段等内容。audapolis重视用户隐私,采用本地存储方式,无需云端服务。该软件支持Windows、Linux和macOS平台,致力于简化媒体编辑工作流程。
Gen-L-Video - 无需额外训练实现多文本条件长视频生成和编辑
Gen-L-VideoGithub多文本条件开源项目无需预训练视频编辑长视频生成
Gen-L-Video是一种扩展短视频扩散模型的视频生成方法,能实现多文本条件下的长视频生成和编辑。该方法无需额外训练即可处理数百帧的视频,并保持内容一致性。Gen-L-Video支持多语义段视频生成、平滑语义变化和视频内容编辑等功能,为长视频处理提供了一种通用解决方案。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号