Project Icon

SciPhi-Mistral-7B-32k

基于Mistral-7B-v0.1增强科学推理与教育能力的AI模型

SciPhi-Mistral-7B-32k是从Mistral-7B-v0.1微调而来的大型语言模型,通过四轮微调和超过十亿个token的数据集,实现了卓越的科学推理及教育能力。其特点包括采用变压器架构、组内查询注意力、滑窗注意力,并支持字节回退BPE分词器。SciPhi-Self-RAG-Mistral-7B-32k当前可用,具体细节可查看相关文档。

Mistral-7B-Instruct-v0.2-GPTQ - 高效量化的开源指令型大语言模型
AI推理GPTQGithubHuggingfaceMistral 7B开源项目模型模型下载量化模型
Mistral-7B-Instruct-v0.2模型的GPTQ量化版本,提供4位和8位精度等多种参数选项。支持Linux和Windows的GPU推理,兼容多个开源框架。采用Mistral提示模板,适用于指令任务。由TheBloke量化发布,旨在提供高效易用的开源大语言模型。
Mistral-Nemo-Instruct-2407-vllm-fp8 - 开源多语言指令微调大模型
Apache 2许可GithubHuggingfaceMistral-Nemo-Instruct-2407多语言大语言模型开源项目指令微调模型
Mistral-Nemo-Instruct-2407是Mistral AI与NVIDIA联合开发的开源指令微调语言模型。该模型在128K上下文窗口训练,支持多语言和代码生成,性能优于同等规模模型。采用Apache 2许可,可替代Mistral 7B使用。模型在多项基准测试中表现出色,支持mistral_inference、transformers和NeMo等框架进行推理。
zephyr-7B-beta-AWQ - 基于Mistral模型优化的高性能7B开源对话模型,支持AWQ量化部署
AI模型GithubHuggingfaceZephyr 7B Beta大语言模型开源项目微调性能评估模型
Zephyr-7B-beta是基于Mistral-7B-v0.1模型的开源对话助手,采用DPO技术训练,在多项基准测试中表现优异。模型支持AWQ 4-bit量化,文件大小仅4.15GB,可通过多种框架高效部署。该项目使用MIT许可证,主要支持英语,适合研究和教育用途。
MistralLite - 适用于长文本处理与问答任务的优化语言模型
GithubHuggingfaceMistralLite亚马逊云服务开源项目微调模型模型长文本处理问答系统
MistralLite作为一种优化的语言模型,基于Mistral-7B,通过适应性转子嵌入和滑窗技术,支持32K tokens的长文本处理。它适用于长文本检索、摘要和问答等应用,尤其适合资源有限的环境。可在单个AWS实例轻松部署,支持HuggingFace TGI和vLLM等框架,适合复杂文本场景的精准解析。
Phi-3-medium-4k-instruct - 轻量级多任务语言模型
GithubHuggingfacePhi-3大语言模型开源项目指令微调推理能力模型自然语言处理
Phi-3-medium-4k-instruct是一个14B参数的轻量级开源语言模型,在常识、语言理解、数学和编码等多项基准测试中表现优异。该模型采用高质量合成数据和公开数据训练,经过指令微调和安全优化,支持4K上下文长度。它适用于内存/计算受限环境和低延迟场景,可广泛应用于商业和研究领域。
Ministral-8B-Instruct-2410 - 多功能高效语言模型,兼具多语言和代码处理能力
GithubHuggingfaceMinistral-8B-Instruct-2410Mistral AI开源项目授权使用模型研究目的许可证
Ministral-8B-Instruct-2410是一款高效的语言模型,具有128k上下文窗口、函数调用支持和多语言代码训练等特点,显著提升同类模型性能。该模型适用于本地智能设备和边缘计算,经过针对性优化以提升多语言和代码处理能力。根据Mistral Research License,该模型适用于非商业研究。Ministral-8B在知识、常识、代码、数学及多语言基准测试中表现优异,为广泛应用提供了强大的支持。
zephyr-7b-sft-full - Mistral-7B衍生的微调语言模型 基于UltraChat数据集
GithubHuggingfaceMistral-7B开源项目机器学习模型模型微调深度学习神经网络
zephyr-7b-sft-full是基于Mistral-7B-v0.1的微调语言模型,利用HuggingFaceH4/ultrachat_200k数据集训练而成。该项目采用多GPU分布式训练,结合Adam优化器和余弦学习率调度,在评估集上实现0.9353的损失值。模型基于Transformers 4.36.2框架和PyTorch 2.1.2环境开发,旨在提供高效的语言处理功能。
e5-mistral-7b-instruct - 多语言NLP任务的全能型模型
GithubHuggingfaceMTEB开源项目性能指标模型模型评估自然语言处理跨语言测试
e5-mistral-7b-instruct是一个多语言自然语言处理模型,在MTEB基准测试中表现出色。模型能够处理句子相似度、文本分类、信息检索和文本聚类等任务,支持英语、德语、法语等多种语言。在Amazon评论分类和BUCC双语文本挖掘等复杂NLP任务中,该模型在准确率、F1分数和平均精度(MAP)等指标上均取得了良好成绩,展现了其在跨语言和多领域应用中的实用价值。
speechless-code-mistral-7b-v1.0 - 全面支持多语言的代码生成与推理模型
GPTQGithubHuggingfacePythonSpeechlessCoder开源项目文本生成模型模型优化
该项目展示了一款专注于代码生成和推理的模型,具备提升推理和规划能力的特点。其多种量化选项支持8位以下的CPU+GPU推断,使其在多种编程语言上均表现不俗。模型经过微调,覆盖了201,981个样本的数据集,包括编码、推理和规划样本,支持Alpaca指令格式。在HumanEval基准测试中通过率达51.22%,适用于多种编程语言的验证,如Python、Java、C++等,为编程助手和代码验证提供支持。
miqu-1-70b - 高性能70B大语言模型,支持32k上下文,采用Mistral格式
GithubHuggingfacemiqu 70b人工智能大型语言模型开源项目提示词格式模型模型设置
miqu-1-70b是一款采用Mistral格式的大型语言模型,具有32k tokens的上下文处理能力。模型采用高频基础ROPE设置,无需额外调整即可发挥优秀性能。经过温度系数1和top_p 0.95的参数组合测试,该模型适用于广泛的自然语言处理任务。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能,包括文生视频、动态画面和形象生成等,帮助用户快速上手,创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台,用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品,帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型,为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能,满足事务性工作的高频需求,帮助撰稿人节省精力,提高效率,优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号