pythia-6.9b-deduped

面向大规模语言模型研究的开源模型系列

数据集去重 Huggingface 语言模型模型训练科学研究 Pythia 模型 Github 开源项目

Pythia-6.9b-deduped为可解释性研究提供了一套8种大小的模型，每种大小有去重和未去重版本。该模型在性能上可与同类模型媲美，统一的训练方法推动科学研究，并提供154个中间检查点供研究使用

quantized-models - 提供多源量化模型以提升大语言模型推理效率

GithubHuggingfacequantized-modelstransformers大型语言模型开源项目文本生成推理模型量化模型

quantized-models项目整合了多种来源的量化模型，旨在提高大语言模型的推理效率。模型支持者包括TheBloke、LoneStriker、Meta Llama等，提供gguf、exl2格式的支持。用户可通过transformers库便捷地进行文本生成，这些模型按现状发布，需遵循其各自的许可协议。

Yi-9B-200K - Yi-9B-200K模型增强长文本处理，优化语言理解与推理

GithubHuggingfaceTransformerYi系列双语大型语言模型开源开源项目模型

Yi系列开源语言模型通过Yi-9B-200K提升长文本解析能力，表现于代码、数学和逻辑推理上尤为突出。该模型使用截至2023年6月的数据集训练，跨语言功能强大，适用于个人、学术和商业环境。

gpt-j-6b - 基于The Pile数据集训练的60亿参数大规模语言模型

EleutherAIGPT-J 6BGithubHuggingfacetransformer开源项目模型自然语言处理语言模型

GPT-J 6B是EleutherAI团队开发的60亿参数大规模语言模型，基于The Pile数据集训练。模型采用Mesh Transformer JAX架构，包含28层和4096维度结构。在多项自然语言处理任务中表现优异，但存在产生不当内容的风险。主要用途为文本生成，不适合直接部署于用户应用，需要人工审核和监督。

prometheus-7b-v2.0 - 用于语言模型评估的开源工具与反馈优化

GithubHuggingfacePrometheus 2开源项目权重合并模型相对评分绝对评分语言模型

Prometheus 2 是一款基于 Mistral-Instruct 的开源语言模型，通过细粒度评估替代 GPT-4 的某些功能。它通过反馈数据微调，支持直接和相对评价。权重合并提升性能，且通过人类反馈优化强化学习模型，适用于多领域评估任务。

aya-expanse-8b - Aya Expanse 8B开源多语言模型研究成果

Aya ExpanseGithubHuggingfaceTransformer架构多语言能力大规模语言模型开源项目模型非商业用途

Aya Expanse 8B是由Cohere For AI开发的多语言大语言模型，注重数据套利、多语言偏好训练、安全调优和模型合并等研究领域。它支持23种语言，具有8亿参数的先进架构。用户可以使用Cohere Playground或Hugging Face进行互动探索。该模型在CC-BY-NC许可证下发布，仅限非商业用途。了解更多信息，请访问相关博客和评估数据集。

Phi-3-mini-4k-instruct-gguf - 轻量级通用AI模型支持推理分析与代码生成

GithubHuggingfacePhi-3人工智能大语言模型开源项目机器学习模型模型训练

Phi-3-mini-4k-instruct-gguf采用GGUF格式实现的轻量级语言模型，具备3.8B参数规模和4K上下文长度支持。该模型在常识理解、数学计算、代码生成等方面表现突出，适合在计算资源受限环境下运行。模型经过安全性优化，可用于英语场景的商业及研究应用。

Phi-3.5-MoE-instruct - 轻量级高性能多语言开源模型

GithubHuggingfacePhi-3.5-MoE多语言开源项目推理能力模型语言模型长文本处理

Phi-3.5-MoE-instruct是一款高性能开源多语言模型。采用混合专家架构,仅用6.6B活跃参数即可实现优异性能。支持128K上下文长度,在推理、数学和代码生成等方面表现出色。模型专注高质量推理数据,经过严格微调和安全增强,适用于商业和研究领域。

Phi-3-medium-128k-instruct-quantized.w8a16 - 优化为INT8的14亿参数开源模型，提升计算效率

GithubHuggingfacePhi-3-medium-128k-instructvLLM开源项目文本生成模型模型优化量化

Phi-3模型的量化版本，通过将权重量化为INT8，将参数位数从16减少至8，约减少50%的磁盘和GPU使用，仍保有高性能。专为英语商业与研究用设计，不适用于违法行为。支持在vLLM和Transformers中高效部署，平均分数74.04逼近未量化版本。在OpenLLM基准中展现优异准确性与恢复能力。

Yi-1.5-9B - 融合代码、数学与推理能力的开源语言大模型

GithubHuggingfaceYi-1.5人工智能开源项目模型深度学习自然语言处理语言模型

Yi-1.5作为Yi系列模型的迭代版本，基于500B语料预训练和300万样本微调，具备语言理解、常识推理和阅读理解等基础能力，并强化了代码、数学和推理功能。模型提供6B、9B和34B三种参数规模，支持4K至32K上下文长度，预训练数据量为3.6T tokens。在基准测试中，Yi-1.5系列模型与同规模开源模型相比表现出竞争力。

bert-base-greek-uncased-v1 - 基于BERT的希腊语语言模型实现

BERTGithubGreekBERTHuggingface希腊语开源项目模型自然语言处理语言模型

bert-base-greek-uncased-v1项目是一种基于BERT的希腊语语言模型，通过希腊语维基百科、欧盟议会文本和OSCAR语料库进行预训练，适用于PyTorch和TensorFlow 2平台。该模型现已集成于Hugging Face的Transformers库，并支持希腊语文本预处理以去除重音符号和转换为小写。这款模型在命名实体识别和自然语言推理任务上表现优越，是研究人员和开发人员的有效工具。

推荐项目

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com