Project Icon

ul2

融合多种预训练范式的通用语言模型

UL2是一个创新的语言模型框架,采用混合去噪器(MoD)预训练目标,融合多种预训练范式并引入模式切换机制。该模型在C4语料库上进行200亿参数规模的预训练,并在多个数据集上微调后,在50个涵盖语言生成、理解和推理等领域的NLP任务中达到了领先水平。UL2在少样本学习方面表现突出,零样本SuperGLUE任务上超越了更大规模的GPT-3模型。

ultravox-v0_3 - 集成语音和文本输入的多模态AI模型
GithubHuggingfaceLlamaUltravoxWhisper多模态模型开源项目模型语音识别
Ultravox-v0_3是Fixie.ai开发的多模态语音大语言模型,结合Llama3.1-8B-Instruct和Whisper-small技术。该模型可同时处理语音和文本输入,适用于语音助手、翻译和分析等场景。通过知识蒸馏方法,仅训练多模态适配器,保持基础模型不变。Ultravox在语音识别和翻译任务中展现出优秀性能,为语音交互应用提供了新的可能性。
ultravox - 实现实时语音交互的多模态大语言模型
GithubLlama 3Ultravox多模态LLM实时语音开源项目语音识别
Ultravox 是一个创新的多模态大语言模型,能直接理解文本和语音,无需单独的语音识别步骤。基于 Llama 3 模型,它通过多模态投影器将音频转换为高维空间。Ultravox 的首字响应时间约为 200 毫秒,每秒可生成约 100 个 token,有效支持实时语音交互。目前支持音频输入和文本输出,未来计划增加语音输出功能。
Llama-2-7B-GGUF - Meta开源的大型语言模型GGUF量化格式版本
GGUFGithubHuggingfaceLlama 2Meta开源开源项目模型语言模型
Llama 2 7B GGUF是Meta开源语言模型的优化版本,采用llama.cpp团队开发的GGUF量化格式。该版本提供2-8比特多种量化选项,支持CPU和GPU推理,可满足不同场景的部署需求。项目包含模型下载、运行指南以及主流框架的集成方法,方便开发者快速上手使用。
llama-3-2-1b-sft - 超大规模对话数据集的精细调优AI模型
GithubHuggingfacellama-3-2-1b-sft开源项目微调模型训练数据集超参数超大规模语言模型
该项目将NousResearch的Llama-3.2-1B模型进行精细调优,使用HuggingFaceH4/ultrachat_200k数据集以提高对话处理性能。在多GPU分布式训练中,使用Adam优化器和余弦学习率调度策略,该模型在验证集上的损失率降低至1.2759。适用于广泛的自然语言处理应用,特别是在对话生成和交互式AI领域中。
Llama-2-13b-hf - Meta开源的130亿参数语言模型 适用于多种NLP任务
GithubHuggingfaceLlama 2人工智能元宇宙大语言模型开源项目模型自然语言处理
Llama-2-13b-hf是Meta开发的大规模语言模型,拥有130亿参数。该模型在2万亿tokens的公开数据上预训练,采用优化的Transformer架构。它支持对话、问答、文本生成等多种NLP任务。与Llama 1相比,Llama 2在代码、常识推理、世界知识等基准测试中表现更佳。此模型开源可用于商业和研究,为AI应用开发奠定了基础。
chinese_roberta_L-2_H-128 - 使用多模态预训练优化中文自然语言处理
CLUECorpusSmallGithubHuggingfaceRoBERTa开源项目模型语言模型预训练
该项目包括24种中文RoBERTa模型,使用CLUECorpusSmall数据集进行训练,效果超过较大数据集。模型通过UER-py和TencentPretrain预训练,并支持多模态框架,参数超过十亿。模型可在HuggingFace和UER-py Modelzoo中获取。项目提供详细的训练过程和关键细节,便于结果复现,着重提升中文自然语言处理任务中的性能。
UltraChat - 大规模、多样化的多轮对话数据和模型
GithubUltraChatUltraFeedbackUltraLM开源项目数据集模型
UltraChat项目专注于构建开源、大规模、多轮对话数据,目标是打造具有广泛会话能力的强大语言模型。最新发布的模型和数据集包括UltraLM-13B-v2.0、UltraRM和UltraCM,在AlpacaEval基准测试上表现优异。UltraChat数据集分为三大部分:世界问题、写作与创作、现有材料辅助,对话涵盖了技术、艺术和创业等领域。项目数据仅供研究和教育用途,基于MIT许可证发布。
internlm2-7b - 增强自然语言处理与长文本分析能力
GithubHuggingfaceInternLM开源开源项目性能评测模型长上下文
InternLM2-7B是一款开源自然语言处理模型,以其卓越的语言能力及对20万字符长文本的支持在评测中表现优异。适用于领域适配与复杂任务,提供代码开放与商用使用许可,便于研究与开发者的灵活使用与集成。
internlm2-1_8b - 18亿参数开源语言模型支持20万字超长上下文输入
GithubHuggingfaceInternLM大语言模型开源模型开源项目性能评测模型超长上下文
InternLM2-1.8B是一个18亿参数的开源语言模型,包含基础模型、对话模型和RLHF对齐版本。它支持20万字的上下文输入,在长文本理解、推理、数学和编程方面表现优异。该模型开放学术研究使用,并提供免费商业授权申请渠道。
Llama-2-70b-hf - Meta开发的70亿参数开源大语言模型 支持多样化自然语言处理任务
GithubHuggingfaceLLAMA 2人工智能大语言模型开源开源项目模型自然语言处理
Llama-2-70b-hf是Meta开发的70亿参数大语言模型,基于优化的Transformer架构,支持4k上下文长度。模型在2万亿token公开数据上预训练,通过监督微调和人类反馈强化学习实现对话能力。在多项基准测试中表现优异,适用于对话、问答、推理等自然语言处理任务。作为开源发布的基础模型,为学术研究和商业应用提供了有力支持。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能,包括文生视频、动态画面和形象生成等,帮助用户快速上手,创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台,用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品,帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型,为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能,满足事务性工作的高频需求,帮助撰稿人节省精力,提高效率,优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号