#UForm
uform - 用于内容理解和生成的袖珍型多模态 AI
UForm多模态AI嵌入模型生成模型ONNXGithub开源项目
UForm是一个全面的多模态AI库,涵盖了从文本到图像,乃至视频剪辑的生成与理解等多种功能。支持多种语言,包含轻量级生成模型及高效的预训练变压模型,能够广泛应用于从服务器到智能手机等不同设备。主要优势包括快速的搜索性能、简易的模型部署过程及卓越的多语言应用能力,适用于快速嵌入、语义搜索、图像标题生成和视觉问答等多种场景。
uform-gen2-qwen-500m - 小型多模态模型实现图像描述和视觉问答
图像生成多模态AIHuggingface模型图像理解UFormGithub开源项目视觉问答
UForm-Gen2-Qwen-500m是一款小型视觉语言模型,专注于图像描述和视觉问答。模型结合了ViT-H/14和Qwen1.5-0.5B-Chat,通过预训练和微调提升性能。支持图像描述、问答和多模态聊天功能,在多项基准测试中表现良好,适用于计算资源有限的场景。