Project Icon

llava-onevision-qwen2-72b-ov-chat

多模态大语言模型支持图像、多图和视频交互

llava-onevision-qwen2-72b-ov-chat是一个为聊天场景优化的多模态大语言模型。该模型基于llava-onevision-72b-ov构建,通过迭代DPO训练提升了聊天能力,同时保持了良好的指令遵循能力。模型支持图像、多图和视频交互,在英语和中文方面表现出色。研究显示,其采用的迭代DPO训练方法有效增强了模型的聊天表现。

OLMo-7B-0724-hf - OLMo开放式语言模型促进语言处理技术进步
AI2GithubHuggingfaceOLMo变形金刚开源语言模型开源项目模型自然语言处理
OLMo是由AI2开发的开源语言模型系列,旨在推动语言模型科学研究。该模型基于Dolma数据集训练,采用先进的Transformer结构,实现性能提升和多阶段优化。OLMo-7B-0724-hf具备强大的文本生成能力,适用于文本推理和生成任务。支持在HuggingFace平台上进行加载、微调和评估,且提供多种数据检查点,方便研究与开发。该项目得到多家机构支持,并在多个主要AI任务中表现优异。
minimal-chat - 轻量级多语言聊天应用,支持本地与自定义模型
DockerGithubMinimalChatPWA支持开源开源项目语言模型
开源轻量级聊天应用,支持GPT-4 Omni等多种语言模型和本地/自定义模型端点,具备移动PWA支持。可通过Docker自托管,能转换和编辑消息,支持语音互动、Markdown和代码高亮,并集成DALL-E 3。提供导入导出对话功能,兼容Open AI响应API端点,支持离线使用,对话本地存储确保安全。
GLM-4 - 多语言支持与长文本处理能力
AI对话GLM-4Github多模态大语言模型开源项目长文本
GLM-4-9B系列是智谱AI推出的开源预训练模型,包括基础版、支持128K上下文的Chat版、1M长文本版及多模态版。该系列支持26种语言,在语义理解、数学计算、逻辑推理等多项评测中表现优异。GLM-4-9B-Chat具备网页浏览、代码执行等功能,GLM-4V-9B则增加了视觉理解能力。这些模型在多项基准测试中均超越了同规模竞品。
BotChat - 创新评估大语言模型多轮对话能力的基准
BotChat BenchmarkGPT-4GithubLLM对话生成开源项目评估
BotChat基准测试通过分析大语言模型生成的对话评估多轮聊天能力。基于MuTual-Test数据集,该项目生成了大规模模型对话数据,并采用单轮评估、BotChat Arena和人类对话对比等方法全面评估主流LLM对话质量。研究发现GPT-4表现最佳,部分小型开源模型在短对话中也有不错表现。这一创新基准为改进LLM对话能力提供了新思路。
llama3-Chinese-chat - llama3中文版上线,提供多样化微调和部署选项
API部署Githubllama3中文化开源项目微调模型训练
llama3中文版本发布,提供丰富中文对话数据集和多种微调选项(如DPO、SFT、RLHF)。项目包含详细的API部署教程、本地LMStudio教程和vLLM云端部署方式,适用于不同用户需求。欢迎加入,完善中文AI模型。
DeepSeek-V2-Lite-Chat-GGUF - DeepSeek量化聊天模型介绍与常用配置
DeepSeek-V2-Lite-ChatGithubHuggingfaceLlamaEdge开源项目模型系统消息质量损失量化模型
DeepSeek-V2-Lite-Chat-GGUF通过多种量化版本适配多样需求,其中推荐Q5_K_M版本以保证质量。用户可通过LlamaEdge实现模型运行,并根据多种上下文配置,应对不同应用场景。
VILA - 创新的视觉语言模型预训练方法
GithubVILA多模态开源项目视觉语言模型量化预训练
VILA是一种新型视觉语言模型,采用大规模交错图像-文本数据预训练,增强了视频和多图像理解能力。通过AWQ 4位量化和TinyChat框架,VILA可部署到边缘设备。该模型在视频推理、上下文学习和视觉思维链等方面表现出色,并在多项基准测试中获得了优异成绩。项目完全开源,包括训练和评估代码、数据集以及模型检查点。
LLaVAR - 优化视觉指令微调的文本丰富图像理解模型
GithubLLaVAROCR能力多模态大语言模型开源项目文本丰富图像理解视觉指令微调
LLaVAR项目致力于增强大型语言模型对文本丰富图像的理解能力。通过改进视觉指令微调方法,该项目显著提升了模型在OCR相关任务上的表现。LLaVAR开源了模型权重、训练数据,并提供了环境配置、训练脚本和评估方法,为相关研究和开发提供了全面支持。
allchat - 全能AI交互平台,集成多模型、图像处理、文档管理及代码执行
AI助手AllChatGithubWeb工具多模型交互开源项目聊天功能
AllChat是一个开源的AI交互平台,整合了多个主流AI模型。它提供历史记录、图像处理、文档管理、代码执行等功能,并支持Markdown格式。通过Web工具,AllChat实现了AI模型与实际应用的无缝连接。这个全面的AI助手旨在满足各类复杂AI应用需求,为用户提供便捷的AI交互体验。
Linly - 中文LLaMA和Falcon模型:优化的中文预训练和对话能力
FalconGithubLLaMALinly-OpenLLaMA中文对话模型开源项目训练数据
该项目提供中文对话和基础模型,包括Linly-ChatFlow、Chinese-LLaMA和Chinese-Falcon模型及其训练数据。通过扩充LLaMA和Falcon的中文词表,使用中英文语料进行预训练,提升了模型在中文语境中的表现。项目还包括Linly-OpenLLaMA模型,支持量化和边缘设备推理。最新的Linly-Chinese-LLaMA-2模型通过混合语料预训练并定期更新,用户可以在线体验和在本地环境中进行训练和评估。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计 是一个多功能的在线设计和创意平台,提供广泛的设计工具和资源,以满足不同用户的需求。从专业的图形设计师到普通用户,无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑,稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合,帮助用户轻松实现创意设计。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号