EMO

音频驱动的富表情肖像视频生成模型

EMO是一种音频到视频的扩散模型，可在弱条件下生成表现力丰富的肖像视频。该项目由阿里巴巴智能计算研究院开发，将音频输入转化为面部表情和头部动作，增强数字人物的自然度和情感表达。EMO技术在虚拟主播和数字人互动等领域具有应用潜力，可提供更真实的视觉体验。

访问官网

Github

论文

介绍相关项目

videollm-online - 流式视频实时理解与交互的先进模型

GithubVideoLLM-online大语言模型实时交互开源项目流媒体视频视频处理

VideoLLM-online是一款针对流媒体视频的在线大语言模型。该模型支持视频流实时交互，可主动更新响应，如记录活动变化和提供实时指导。项目通过创新的数据合成方法将离线注释转化为流式对话数据，并采用并行化推理技术实现高速处理，在A100 GPU上处理速度可达10-15 FPS。VideoLLM-online在在线和离线环境中均表现出色，能高效处理长达10分钟的视频，为视频理解与交互领域带来新的可能性。

torchMoji - 基于表情符号的情感分析深度学习模型

DeepMojiGithubTorchMoji开源项目情感分析深度学习自然语言处理

TorchMoji是PyTorch实现的DeepMoji模型，通过分析12亿条带表情符号的推文来理解语言表达情感的方式。该模型利用迁移学习在多个情感相关的文本建模任务中实现了优秀性能。项目包含预训练模型、数据处理工具和示例代码，方便研究者和开发者将情感分析应用于各种文本理解任务。TorchMoji模型可用于情感分类、情感强度预测和讽刺检测等任务，为自然语言处理研究和应用提供了有力工具。

EmoLLM - 心理健康大模型

EmoLLMGithubInternLM2_5_7B_chatModelScopeOpenXLab开源项目心理健康

EmoLLM是一个心理健康大模型，旨在提升个体和群体的心理健康。通过微调InternLM、Qwen、Baichuan等多种LLM模型，实现认知、情感和行为分析。EmoLLM具备情感调节和评估功能，结合预防和干预措施，促进心理韧性。项目提供丰富的模型配置和开源资源，适用于日常使用及学术研究，提供全面的心理健康支持。

Genmo - 将AI视频和图像转化为现实的创意工具

AI创意工具AI工具AI视频生成Genmo图像转视频文本转视频

Genmo是一个基于人工智能的创意平台，专注于生成视频、3D模型、图像和艺术作品。平台利用Stable Diffusion等先进AI技术，包括最新的Replay v0.2模型，支持通过文本或图像输入创建多样化的视觉内容。Genmo提供免费的AI视频制作功能，支持文本到图像、文本到视频等多种创作模式。作为便捷高效的AI工具，Genmo致力于为创作者激发灵感，将创意转化为现实。

motionshop - 视频角色3D化身替换应用让创意无限

3D头像AI视频处理GithubMotionShop人物动画开源项目视频替换

MotionShop是一个开源应用程序，可将视频中的真实人物替换为3D虚拟化身。该应用可用于视频创作、虚拟现实内容制作等领域，为创作者提供新的表现形式。项目已在ModelScope上线体验demo，计划在HuggingFace推出。开发团队持续优化项目，鼓励用户体验并分享创作成果。

StoryDiffusion - 实现长序列图像和视频的一致性生成

AI生成GithubStoryDiffusion一致性自注意力开源项目长序列图像生成长视频生成

StoryDiffusion是一个专注于长序列图像和视频生成的AI项目。该项目采用一致性自注意力机制，实现角色连贯的图像生成，并通过运动预测器在压缩图像语义空间中预测条件图像间的运动。StoryDiffusion不仅能生成连贯的漫画，还可创作长时间、高质量的视频，为故事创作和视觉内容生成提供了新的技术方案。

DeepMoji - 情感分析模型，基于12亿推文训练，支持迁移学习与多情感预测

DeepMojiGithubKerastorchMoji开源项目情感分析机器学习

DeepMoji是一个情感分析模型，基于12亿推文数据训练，可通过迁移学习在多种情感任务中表现出色。项目包含代码示例和预训练模型，兼容Python 2.7和Keras框架，适用于情感预测和文本编码。还提供了PyTorch实现，用户可使用不同模块进行数据处理、模型微调和测试。

VideoElevator - 融合文本到图像技术提升AI视频生成质量

GithubVideoElevator开源项目扩散模型文本到图像文本到视频视频生成

VideoElevator是一个开源的AI视频生成项目，通过结合文本到图像和文本到视频的扩散模型来提升生成视频的质量。该项目采用免训练、即插即用的方法，将视频生成过程分为时间运动细化和空间质量提升两个阶段。VideoElevator能在11GB以下显存的GPU上运行，支持多种扩散模型的协作，为高质量AI视频生成提供了新的解决方案。

Stable Video Diffusion Online - AI驱动的图像到视频转换在线平台

AI工具AI视频生成Stable Video Diffusion图像到视频转换生成式视频视频创作工具

Stable Video Diffusion Online提供基于Stable Diffusion模型的AI图像到视频转换服务。该工具支持3-30fps的灵活视频生成，适用于广告、社交媒体内容和表情包制作等多种场景。平台提供多种订阅计划，满足不同用户需求，简化了高质量视频内容的创作过程。利用先进的AI技术，用户可以轻松将静态图像转换为高分辨率视频，为创意制作提供便捷的解决方案。

StyleAvatar3D - 创新3D头像生成技术融合图像文本扩散模型

3D头像生成GithubStyleAvatar3D图像文本扩散模型多视图图像开源项目生成对抗网络

StyleAvatar3D是一种新型3D头像生成方法，结合预训练图像文本扩散模型和GAN技术。该方法利用扩散模型先验知识生成多视角、高质量、多样化头像图像，通过特殊判别器和提示词技术解决数据不对齐问题。项目还开发了潜在扩散模型，可基于输入图像生成头像。StyleAvatar3D在视觉质量和多样性方面优于现有技术。

相关项目

推荐项目

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

稿定AI

稿定设计是一个多功能的在线设计和创意平台，提供广泛的设计工具和资源，以满足不同用户的需求。从专业的图形设计师到普通用户，无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑，稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合，帮助用户轻松实现创意设计。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com