Project Icon

Qwen1.5-72B-Chat

支持多语言的720亿参数开源语言模型

Qwen1.5-72B-Chat作为Qwen2的预发布版本,集成了从5亿到720亿参数的8种规模模型。模型采用Transformer架构和SwiGLU激活函数,支持32K上下文长度和多语言处理。通过Hugging Face框架即可部署使用,同时提供GPTQ、AWQ等多种量化版本,可满足不同场景需求。

Qwen2-7B - 开源大语言模型在多项基准测试中展现优异性能
GithubHuggingfaceQwen2人工智能大语言模型开源项目机器学习模型自然语言处理
Qwen2-7B是新一代Qwen大语言模型系列的7B参数基础版本。该模型在语言理解、生成、多语言处理、编程、数学和推理等多个领域的基准测试中展现出优异表现,不仅超越了大多数开源模型,还与专有模型实力相当。Qwen2-7B基于改进的Transformer架构,引入了SwiGLU激活函数、注意力QKV偏置和组查询注意力等创新技术,并优化了分词器以更好地支持多种自然语言和编程语言。
Qwen2-0.5B - 阿里巴巴推出的高性能开源大语言模型
GithubHuggingfaceQwen2人工智能大语言模型开源项目模型模型评估自然语言处理
Qwen2-0.5B是阿里巴巴发布的新一代大语言模型系列中的0.5B参数版本。该模型在语言理解、生成、多语言能力、编程、数学和推理等多个基准测试中表现优异,性能超越大多数开源模型。Qwen2-0.5B采用改进的Transformer架构,包括SwiGLU激活、注意力QKV偏置和分组查询注意力等技术。作为基础语言模型,Qwen2-0.5B可用于进一步的训练和优化,为开发者和研究人员提供了强大的语言处理基础。
Qwen2.5-3B - 新一代多语言模型提升代码数学和长文本处理能力
GithubHuggingfaceQwen2.5人工智能大语言模型开源项目机器学习模型自然语言处理
Qwen2.5-3B是一款拥有30亿参数的大语言模型,支持32768个token的上下文长度。该模型在代码、数学等领域表现出色,并改进了长文本生成、结构化数据理解和JSON输出能力。它支持128K长文本处理和29种语言,为进一步微调和应用奠定了基础。作为预训练模型,Qwen2.5-3B不建议直接用于对话,但可进行指令微调等后续训练。
Qwen2.5-7B-Instruct-GGUF - 开源大语言模型GGUF量化版支持多语言和128K长文本处理
GithubHuggingfaceQwen2.5人工智能多语言支持大语言模型开源项目模型深度学习
Qwen2.5-7B指令模型GGUF量化版是Qwen2.5系列的一部分,采用transformers架构,拥有7.61B参数。该模型支持29种语言,可处理128K文本上下文,并提供q2至q8多种量化精度选项。相比前代,模型在知识储备、代码、数学能力、指令执行、长文本生成和结构化数据理解等方面均有显著提升。
Qwen2.5-0.5B - 轻量级多语言预训练模型 支持长上下文和结构化输出
GithubHuggingfaceQwen2.5变形器架构多语言支持大语言模型开源项目模型自然语言处理
Qwen2.5-0.5B是一个轻量级预训练语言模型,参数量为0.49B。它支持32,768个token的上下文长度,在代码和数学任务上表现出色,并可处理结构化数据。该模型涵盖29种以上语言,适合指令跟随和长文本生成等应用。作为基础模型,Qwen2.5-0.5B为后续微调和应用开发奠定了基础,展示了其在自然语言处理领域的应用潜力。
Qwen2.5-1.5B-Instruct-GGUF - 多语言文本生成与指令理解能力的优化与突破
GithubHuggingfaceQwen2.5多语言支持大语言模型开源项目指令调整模型长上下文支持
Qwen2.5系列的1.5B模型在多语言支持和长文本生成上取得进展,尤其在编码、数学和指令跟随方面。该模型支持29种语言和128K长上下文,同时更能适应多样化的系统提示,为实现角色扮演和条件设置的聊天机器人提供帮助。仓库中提供GGUF格式的调优模型,旨在提供接近真实对话的交互体验。
Qwen2.5-32B-Instruct-GPTQ-Int8 - 开源多语言大模型Qwen2.5 32B量化版支持超长文本处理
GithubHuggingfaceQwen2.5多语言支持大语言模型开源项目文本生成模型量化
Qwen2.5-32B-Instruct-GPTQ-Int8是Qwen2.5系列的量化版本,通过GPTQ 8位量化技术实现高效部署。模型支持29种语言交互,具备128K超长上下文理解和8K文本生成能力。在编程、数学计算、文本理解等任务中表现优异,同时对结构化数据处理能力显著提升。该模型采用325亿参数规模,适合在资源受限环境中运行
Qwen2.5-14B - 基于transformer架构的多语言预训练模型 具备超长文本理解能力
GithubHuggingfaceQwen2.5多语言支持大语言模型开源项目模型自然语言处理长文本理解
Qwen2.5-14B是一个基于transformer架构的预训练语言模型,具备147亿参数规模。该模型在编程、数学等专业领域表现突出,支持中英法德等29种语言处理,并可处理超长文本内容。模型整合了多项技术优化,在结构化数据理解和指令执行方面表现优异,可作为各类下游AI任务的基础模型使用。
Qwen2.5-32B-Instruct-GGUF - Qwen2.5大模型在生成语言和指令处理方面的显著增强
GithubHuggingfaceQwen2.5多语言支持开源项目指令遵循模型自然语言处理长上下文支持
Qwen2.5系列模型大幅提升了知识积累能力,尤其在编码和数学领域表现出色。其32B模型支持29种以上语言,擅长长文本生成和结构化数据理解。专为指令响应优化,能够在复杂系统提示下维持高效性能。Qwen2.5提供128K Token长上下文支持和8K Token生成能力,拓展了角色模拟应用场景。
Qwen1.5-0.5B-Chat-GGUF - 基于通义千问1.5的轻量级中文对话模型
Apache 2.0GithubHuggingface开源开源项目模型法律许可证软件
Qwen1.5-0.5B-Chat-GGUF是基于通义千问1.5系列的中文对话模型,采用GGUF格式实现。该模型具有较小的尺寸和较快的推理速度,适合在资源受限环境中部署。这个轻量级模型为开发者和研究人员提供了一种高效方式来构建智能对话应用,实现中文语言模型的快速部署和使用。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能,包括文生视频、动态画面和形象生成等,帮助用户快速上手,创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台,用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品,帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型,为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能,满足事务性工作的高频需求,帮助撰稿人节省精力,提高效率,优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号