Project Icon

longchat-13b-16k

开源模型longchat-13b-16k优化长文本对话能力

Longchat-13b-16k使用凝缩旋转嵌入技术进行优化,能有效处理长文本对话,由Dacheng Li等人开发,适用于语言处理及机器学习研究领域。用户可通过FastChat与LongChat加载,凭18K对话训练数据,适合研究者探索其对长对话的扩展潜力。LongEval评估资源和GitHub资料提供更多技术支持和信息。

openchat_3.5 - 开源创新:OpenChat挑战70B模型新高度
C-RLFTGPT4GithubHuggingfaceOpenChat对话生成开源语言模型开源项目模型
OpenChat通过C-RLFT策略实现了在混合质量数据上的无偏好标签微调,性能与ChatGPT相媲美,并在多项测试中超越更大规模模型。作为一个高性能且具有商业潜力的开源语言模型,OpenChat支持高效部署和OpenAI兼容接口,适用于高通量在线服务,并推动AI开放研究的持续发展,促进技术创新。
starchat2-15b-v0.1 - 基于StarCoder2微调的双能力开源语言模型
GithubHuggingfaceStarChat2人工智能代码生成大模型开源项目模型语言模型
StarChat2-15b-v0.1是一款基于StarCoder2的开源语言模型,拥有160亿参数规模。该模型通过合成数据集微调,在MT Bench、IFEval聊天评测及HumanEval代码测试中展现了均衡性能。模型支持600多种编程语言,具备代码生成和对话交互功能。开发者可通过Transformers框架调用,需注意模型存在输出偏差等局限性。
chatglm3-6b - 强大基础模型支持多功能复杂对话场景
ChatGLM3-6BGithubHuggingface人工智能多功能对话模型开源开源项目模型
ChatGLM3-6B是ChatGLM系列的最新开源对话模型,基于强大的基础模型构建。它支持多轮对话、工具调用、代码执行和Agent任务等复杂场景,采用新的Prompt格式。在10B以下预训练模型中,ChatGLM3-6B性能出众。该模型对学术研究开放,登记后可免费商用,为自然语言处理领域提供了强大工具。
ChatLM-mini-Chinese - 小参数中文对话模型,支持低显存预训练,优化SFT和DPO性能
ChatLM-Chinese-0.2BGithubHuggingfaceRLHF优化SFT微调开源项目预训练
ChatLM-mini-Chinese是一个小参数中文生成式语言模型项目。模型参数为0.2B,最低4GB显存即可实现预训练,512MB显存可进行推理。项目公开预训练和优化数据集,包括SFT微调和DPO偏好优化,支持多种下游任务。基于Huggingface NLP框架,自实现trainer,支持单机单卡及多卡训练,并可断点续训。此项目优化了内存和显存的使用,为硬件资源不足的用户提供了一种高效的中文对话解决方案。
UltraChat - 大规模、多样化的多轮对话数据和模型
GithubUltraChatUltraFeedbackUltraLM开源项目数据集模型
UltraChat项目专注于构建开源、大规模、多轮对话数据,目标是打造具有广泛会话能力的强大语言模型。最新发布的模型和数据集包括UltraLM-13B-v2.0、UltraRM和UltraCM,在AlpacaEval基准测试上表现优异。UltraChat数据集分为三大部分:世界问题、写作与创作、现有材料辅助,对话涵盖了技术、艺术和创业等领域。项目数据仅供研究和教育用途,基于MIT许可证发布。
Llama3-ChatQA-1.5-8B - 强化对话问答和检索增强生成的高性能AI模型
GithubHuggingfaceLlama3-ChatQA-1.5人工智能开源项目检索增强生成模型自然语言处理问答系统
基于Llama-3开发的大语言模型,专注于优化对话式问答和检索增强生成能力。模型提供8B和70B两个版本,采用改进的训练方案,增强了表格理解和算术计算能力。在ChatRAG Bench评测中,模型在多个数据集上表现优异,尤其擅长处理上下文对话和文档检索。支持完整文档输入和分块检索两种使用方式,适用于多种对话问答场景。
glm-4-9b-chat-1m - 广泛语言支持与长文本处理能力的先进预训练模型
GLM-4-9BGithubHuggingface多语言支持开源项目机器学习模型长文本能力预训练模型
GLM-4-9B-Chat-1M 是智谱 AI 开发的先进预训练模型,具备网页浏览、代码执行和长文本推理等功能,支持 26 种语言,适用于需要大规模上下文处理的应用场景。最新更新提升了处理能力,支持长达 1M 上下文长度。
h2o-danube2-1.8b-chat - 1.8B参数的聊天模型,提升自然语言生成效果
GithubH2O.aiHuggingfaceh2o-danube2-1.8b-chat变压器大语言模型开源项目文本生成模型
H2O.ai推出1.8B参数的h2o-danube2-1.8b-chat模型,基于Llama 2架构,并经过H2O LLM Studio和Mistral分词器微调。该模型适用于多种文本生成应用,支持transformers库中的集成和量化、分片设置,提升计算效率。在基准测试中表现优异,并重视负责与道德使用,欢迎用户反馈以优化性能。
ChatGLM3 - 突破性能与功能的开源对话模型
AIChatGLM3Github大语言模型对话系统开源模型开源项目
ChatGLM3是智谱AI与清华大学KEG实验室联合开发的开源对话模型。该模型在保持对话流畅和易于部署的基础上,引入了更强大的基础架构、更全面的功能支持和多个开源版本。ChatGLM3-6B不仅支持多轮对话,还能进行工具调用和代码执行,在10B以下模型中表现出色。此外,项目还开源了基础模型和长文本版本,为学术研究和商业应用提供了多样化选择。
Llama-2-13b-chat-hf - Meta开发的130亿参数大语言模型支持多种自然语言处理任务
GithubHuggingfaceLlama 2人工智能大语言模型对话系统开源项目模型模型训练
Llama-2-13b-chat-hf是Meta开发的大规模语言模型,拥有130亿参数。该模型经过对话任务微调,在多项基准测试中表现优异,支持文本生成、问答等自然语言处理任务。Llama-2采用公开数据集训练,不含Meta用户数据,提供商业许可。此Hugging Face版本便于研究和开发使用。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计 是一个多功能的在线设计和创意平台,提供广泛的设计工具和资源,以满足不同用户的需求。从专业的图形设计师到普通用户,无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑,稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合,帮助用户轻松实现创意设计。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号