Project Icon

conv-emotion

会话情感识别技术及最新数据集与模型更新

本页面介绍了会话情感识别技术,包括用于识别会话情感的多种基于PyTorch和TensorFlow的模型,如COSMIC、TL-ERC和DialogueGCN。还提供了最新的多模态多方对话数据集和相关基准数据集,并介绍了识别会话情感原因和对话生成的技术。这些技术通过建模对方状态和跨人际依赖关系来实现情感识别。最新更新包括M2H2数据集和相关基线模型,并链接至其他重要项目和研究。

SyncTalk - 同步技术驱动的高质量说话头像合成
CVPRGithubSyncTalk人工智能头像合成开源项目计算机视觉
SyncTalk项目通过三平面哈希表示法实现高度同步的说话头像视频合成。该技术生成同步的唇部运动、面部表情和稳定的头部姿势,同时还原发型细节,创造高分辨率视频。在保持人物身份的同时,项目显著提升了说话头像的自然度和真实感。
speechbrain - 加速对话AI开发的开源PyTorch工具包
GithubPyTorchSpeechBrain人工智能开源项目聊天机器人语音处理
SpeechBrain是一个基于PyTorch的开源框架,专注于对话AI技术的快速开发,涵盖语音助手、聊天机器人和大型语言模型。该项目包含超过200个训练配方,覆盖40个数据集进行20种语音和文本处理任务。支持从零开始构建模型或微调如Whisper、Wav2Vec2等预训练模型。此外,SpeechBrain通过30多个Google Colab教程促进教育和学习,帮助用户深入了解对话AI系统。
awesome-LLMs-In-China - 中国AI大模型全面收录及发展动态
ChatGLMGithubLLaMA人工智能大模型开源开源项目
这个项目系统收录了中国AI大模型的详细信息,涵盖机构、来源和分类等。通过持续更新,记录各类大模型的发展动态,包括百度文心一言、阿里通义千问等知名通用模型,以及医疗、金融等专业领域模型。项目还提供评测数据集和开源基础模型列表,为研究中国AI发展提供全面参考。
awesome-ai-tools - AI工具与大语言模型推荐
AI工具GithubOpenAI开源项目搜索引擎生产力工具聊天机器人
全面了解各种顶级生成式AI工具与大语言模型,如OpenAI API、ChatGPT和Claude 3等。从文本生成、编程到图像、视频和音频生成,这里提供最完整的AI工具推荐,并支持免费提交和展示自己的AI产品。探索最新AI工具,紧跟技术创新前沿。
Video-ChatGPT - 创新视频对话技术开启细致视频理解新纪元
GithubVideo-ChatGPT多模态大型视觉语言模型开源项目视频理解问答系统
Video-ChatGPT是一个融合大型视觉和语言模型的视频对话系统。该项目构建了10万条视频-指令对数据集,开发了首个视频对话量化评估框架,在视频推理、创意生成、空间和时间理解等任务中表现出色。这一开源项目为视频内容理解和人机交互带来了新的发展方向。
Emooji - 在线智能文本转表情符号翻译器
AI工具
Emooji是一款免费的在线表情符号翻译工具(emoji translator),将普通文本智能转换为生动的表情符号组合。该工具能根据输入内容快速生成独特的emoji序列,为社交媒体交流增添趣味。适用于日常对话、经典台词和情感表达,Emooji将文字转化为丰富的表情符号,为消息增添活力。这款免费表情符号翻译器(free emoji translator)操作简单,适合希望在数字交流中增添情感色彩的用户。
chatbot - 可用自定义语料训练的中文聊天机器人
GPT模型GithubMindSporeRLHFSeq2Seqchatbot开源项目
该项目提供一个可用自定义语料训练的中文聊天机器人,并即将推出GPT版本,新增MindSpore支持。项目包含Seq2Seq和GPT两大分支,计划于2024年内实现类似mini-GPT4的图文多模态对话功能,并增强分布式集群训练能力。用户可下载小黄鸡语料进行实践,项目支持TensorFlow和PyTorch。
Multilingual_Text_to_Speech - 多语言文本到语音合成技术
GithubMeta-learningTacotron 2多语言文本转语音开源项目神经网络模型语音合成
Multilingual_Text_to_Speech项目综合采用Tacotron 2模型与元学习技术,支持复杂的多语言语音合成实验,提供完善的编码器共享机制,并包含丰富的语言数据及互动示范,旨在推动学术研究及应用开发。
Awesome-Embodied-AI - 具身人工智能前沿研究资源汇总
Embodied AIGithub多智能体系统大语言模型导航开源项目机器人
本项目汇集了具身人工智能(Embodied AI)领域的精选资源,包括最新研究论文、工具及相关资料。内容涵盖语言模型驱动的智能体、机器人技术、导航等多个方向,全面追踪具身AI的研究和产业进展。为研究人员和开发者提供参考,深入探讨智能体在物理或虚拟环境中的感知、决策和行动机制。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计 是一个多功能的在线设计和创意平台,提供广泛的设计工具和资源,以满足不同用户的需求。从专业的图形设计师到普通用户,无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑,稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合,帮助用户轻松实现创意设计。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号