Project Icon

attention_sinks

调整预训练的 LLM 以使用修改后的滑动窗口注意力形式

通过`attention_sinks`改进预训练语言模型,结合滑动窗口注意力,实现流畅文字生成。与传统`transformers`不同,保持显存恒定使用,确保高效性能。支持Llama、Mistral、Falcon、MPT、GPTNeoX等多种模型,适用于多步生成任务,如聊天机器人。详细benchmark测试结果显示,该技术在处理数百万个令牌后依然保持低困惑度和高流畅度,是多任务处理的理想选择。

Chinese-LLaMA-Alpaca-2 - 基于Meta发布的可商用大模型Llama-2开的中文LLaMA&Alpaca大模型的第二期项目
Chinese-LLaMA-Alpaca-2FlashAttention-2Github中文词表大模型开源项目长上下文
Chinese-LLaMA-Alpaca-2项目基于Meta的Llama-2模型开发,提供了全新的中文LLaMA-2基座模型和Alpaca-2指令精调大模型,专注于优化中文词表和扩展模型训练。模型支持大规模中文数据增量训练,显著提升中文语义和指令理解能力。支持4K至64K上下文长度,实现人类偏好对齐,提供多种工具支持部署和应用推广。适用于企业和研究机构进行语言模型深度研发和实用应用,如对话系统和文本分析等。
StableLM - 持续更新的AI语言模型开发与优化平台
AI工具AI开发StabilityAIStableLM人工智能开源模型训练热门语言模型
探索Stability AI的StableLM网站,了解和参与最前沿的AI语言模型开发,通过详细的模型介绍和技术报告,加深对自然语言处理技术的理解和应用。
Llama-3.2-3B-GGUF - 高性能多语言型大语言模型支持8种语言
GithubHuggingfaceLlama 3.2人工智能多语言开源项目机器学习模型语言模型
Llama-3.2-3B是Meta开发的多语言大型语言模型,支持8种语言,适用于对话和代理任务。本项目使用llama.cpp对原模型进行量化,保留了128k上下文长度和分组查询注意力等特性。该模型在行业基准测试中表现优异,可用于聊天、知识检索、摘要等自然语言生成任务,适合商业和研究使用。
Llama-3.1-Nemotron-70B-Instruct-HF-FP8-dynamic - 多语种量化优化模型,显著降低内存占用
GithubHuggingfaceLlama-3.1-Nemotron-70B-Instruct-HF-FP8-dynamic多语言支持开源项目文本生成模型模型优化量化
通过将权重和激活量化为FP8格式,该项目优化了Llama-3.1-Nemotron模型,显著降低了GPU内存与磁盘的占用。模型适用于商业与研究,支持多语言开发和会话助手的构建。利用vLLM,可以实现高效部署并具有OpenAI兼容性。Llama-3.1-Nemotron-70B-Instruct-HF-FP8-dynamic在诸多测试中表现优良,在Arena-Hard评估中达99.41%的恢复率。
Sheared-LLaMA-1.3B-ShareGPT - 优化Sheared-LLaMA模型训练,提高语言模型响应能力
GithubHuggingfaceShareGPTSheared-LLaMA开源项目模型模型训练结构剪枝自然语言处理
该项目通过10,000个指令响应对优化Sheared-LLaMA-1.3B模型,提升语言模型效率和性能。该模型可通过transformers.LlamaModelForCausalLM加载,适用于多种应用场景。
llama-3.1-openhermes-tr - 高效训练和优化的Llama模型应用
GithubHuggingfaceUnslothllamatransformers开源项目模型模型训练
这个开源项目演示了如何利用Unsloth框架和Huggingface的TRL库,加速Llama模型的训练过程。该模型专为文本生成和问答优化,具备高效的执行能力。尤其适用于需快速处理大规模文本数据的场景,如自然语言处理和人工智能开发。通过Python,用户可以简单地加载并使用模型,以实现高效的内容生成。该项目为技术指导和内容创作提供了高效、高质量的解决方案。
mistral-7b-instruct-v0.3-bnb-4bit - Unsloth:加速大型语言模型微调的开源项目
GithubHuggingfaceUnsloth内存优化开源项目微调效率提升模型语言模型
mistral-7b-instruct-v0.3-bnb-4bit项目利用Unsloth技术提高大型语言模型的微调效率。该开源工具可将Mistral、Gemma和Llama 2等模型的微调速度提升2-5倍,同时减少70%的内存使用。项目提供多个针对不同模型的免费Colab笔记本,支持对话式和文本补全等微调任务,便于初学者实现高效模型优化。
LLM-FineTuning-Large-Language-Models - LLM微调实践与技术应用指南
Fine-tuningGithubLLMPEFTQLoRA开源项目量化
本项目介绍了如何使用ORPO、QLoRA、GPTQ等技术对大型语言模型(LLM)进行微调,包含具体实例和代码片段。项目还提供与这些技术相关的YouTube视频链接,提供全面的学习资料。此外,项目还包含各类实用工具和技术说明,帮助用户更好地理解和应用这些前沿技术。适合有一定编程基础的研究人员和开发者参考。
linformer - 线性复杂度自注意力机制的PyTorch实现
GithubLinformerPytorch开源项目深度学习神经网络自注意力机制
Linformer是一个基于PyTorch的高效自注意力机制实现。通过将注意力矩阵投影到低维度空间,它实现了线性复杂度,适合处理长序列数据。项目提供简洁API,支持构建语言模型和自注意力层。尽管在自回归任务和可变序列长度方面有局限,但其高效性已在Facebook的生产环境中得到验证,为处理大规模数据提供了新的解决方案。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号