dolly

基于Pythia-12b开发的指令遵循大型语言模型

Dolly是由Databricks基于Pythia-12b开发的指令遵循大型语言模型，通过约1.5万条指令/响应微调数据集训练。尽管不是最先进的生成模型，但具备高质量的指令遵循能力。Dolly旨在让各类组织和个人都能利用人工智能的变革力量，并提供详细的使用和训练指南，适用于多种GPU配置。

访问官网

pythia-6.9b - 促进大规模语言模型可解释性研究的开源工具

GithubHuggingfacePythia大语言模型开源项目机器学习模型模型训练自然语言处理

Pythia-6.9b是EleutherAI开发的开源大规模语言模型,旨在促进可解释性研究。该模型包含69亿参数,在Pile数据集上训练,提供154个中间检查点,便于研究人员探索模型训练过程。Pythia-6.9b采用Transformer架构,性能与同类模型相当,主要用于学术研究而非直接部署。模型可能存在偏见风险,研究人员可通过Hugging Face Transformers库轻松使用。Pythia-6.9b为语言模型研究提供了理想的实验平台。

Ollama - 接入与定制大型语言模型

AI工具AI开发Gemma 2Llama 3.1MistralPhi 3大型语言模型模型训练热门

Ollama 提供丰富的大型语言模型选择，包括 Llama 3.1、Phi 3、Mistral、Gemma 2 等，适用于 macOS、Linux 和 Windows 进行高效的语言处理任务。平台支持用户按需自定义模型，并提供便捷的下载服务。

mpt-7b-instruct - 短指令学习模型MPT-7B-Instruct优化人工智能响应

GithubHuggingfaceMPT-7B-InstructMosaicML开源项目模型模型架构短文本指令训练效率

MPT-7B-Instruct模型基于MPT-7B，通过微调Dolly-15k和HH-RLHF数据集，提升人工智能在短指令执行上的效率与准确性。其采用修改后的Transformer架构，支持FlashAttention及ALiBi等高效训练选项，便利多种应用场景。MosaicML支持其在商业项目中的应用，但需注意可能存在的偏见或不准确信息，依据Apache 2.0许可使用。

pythia-12b-deduped - 面向解释性研究的大模型工具集

EleutherAIGithubHuggingfacePythiaPython大语言模型开源项目文本预测模型

Pythia Scaling Suite是EleutherAI开发的用于解释性研究的大语言模型集合。该套件包含八种尺寸的模型，每种尺寸有去重和非去重版本，均在相同的数据集和顺序下训练，提供科学实验的受控环境，支持对大型语言模型的行为与功能研究。用户可以在Hugging Face上获取154个中间检查点，并通过开源代码库进行调整和扩展。

pythia-160m - EleutherAI开发的160M参数语言模型专为NLP研究设计

EleutherAIGithubHuggingfacePythia大语言模型开源项目机器学习模型自然语言处理

Pythia-160M是一个160M参数的英语语言模型,由EleutherAI开发,主要用于自然语言处理研究。该模型在Pile数据集上训练,提供154个中间检查点,便于分析模型行为。虽然主要用于研究目的,但其性能可与同规模的商业模型相媲美。Pythia-160M采用Transformer架构,可通过Hugging Face Transformers库轻松加载使用,适合进一步微调,但不建议直接部署。

Delphic - 使用LlamaIndex构建和部署大型语言模型（LLM）代理的简单框架

DelphicDjangoDockerGithubLangchainOpenAI开源项目

Delphic是一个使用LlamaIndex构建和部署大型语言模型（LLM）代理的简单框架，可用于分析和处理文档中的文本数据。虽然框架基于OpenAI的API，但兼容其他LLM，例如Langchain，支持使用Postgres作为向量存储，并通过Docker Compose实现快速本地部署。虽然Delphic项目目前不再维护，但它作为构建流式响应应用的概念验证工具仍具有参考价值。

OpenDalleV1.1 - 超越SDXL性能的开源AI文生图模型

GithubHuggingfaceOpenDalleV1.1Stable Diffusion人工智能绘画图像生成开源项目模型深度学习

OpenDalleV1.1是一个开源AI图像生成模型，比SDXL具有更强的性能表现。模型在图像真实感和艺术风格方面表现突出，能够准确解析提示词并生成对应图像。基于独特的模型合并方法开发，仅限个人非商业使用，支持diffusers框架部署，通过推荐参数配置可生成细节丰富的图像。

datablations - 对在数据限制下扩展语言模型的方法的研究

C4Githublanguage models开源项目数据稀缺数据重复训练数据

本项目研究在数据受限情况下扩展语言模型的方法。通过对9000亿训练令牌和90亿参数模型进行实验，提出并验证了重复令牌和多余参数的计算优化法则。实验涵盖数据增强、困惑度过滤及去重处理。相关模型和数据集公开在仓库，有助于在资源有限情况下高效训练和优化语言模型。

OLMo-Bitnet-1B - 利用1B参数模型验证1位LLM训练新方法

DolmaGithubHuggingfaceOLMo-Bitnet-1B参数模型大模型开源项目模型自然语言处理

OLMo-Bitnet-1B项目验证了1位大型语言模型训练方法的潜力。通过Dolma数据集的60亿标记构建了拥有10亿参数的模型，旨在探索新方法的可行性。项目还进行了fp16权重的对比实验，详情见相关报告。模型支持文本生成，包括示例代码方便研究和应用者评估该技术。

BELLE - 推动中文大语言模型的开源发展与指令微调

BELLEGithub中文优化大语言模型开源社区开源项目指令微调

BELLE项目致力于推动中文对话大模型的开源发展，重点关注如何利用开源预训练大语言模型构建具有指令理解能力的个性化语言模型。该项目持续公开指令训练数据、模型、训练代码和应用场景，同时评估不同训练数据和算法对模型性能的影响。BELLE专门针对中文进行优化，仅采用ChatGPT生成的数据进行模型调优，不包含其他来源的数据。

推荐项目

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能，包括文生视频、动态画面和形象生成等，帮助用户快速上手，创造专业级内容。

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台，用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品，帮助用户探索创意灵感。

讯飞文书

讯飞文书依托讯飞星火大模型，为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能，满足事务性工作的高频需求，帮助撰稿人节省精力，提高效率，优化工作与生活。

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com