Project Icon

P-tuning-v2

深度提示调优技术提升小型模型性能 媲美传统微调方法

P-tuning v2是一种创新的提示调优策略,通过深度提示调优技术为预训练Transformer的每层输入应用连续提示。这种方法显著提升了连续提示的容量,有效缩小了与传统微调方法的性能差距,尤其在小型模型和复杂任务中表现突出。研究表明,P-tuning v2在BERT和RoBERTa等模型上取得了优异成果,在多项NLP任务中达到了与微调相当的水平,为发展参数高效的模型调优技术开辟了新途径。

gpt-llm-trainer - AI模型训练自动化工具 从任务描述到高性能模型
AI训练GPT-3.5GithubLLaMA 2开源项目数据集生成模型微调
gpt-llm-trainer是一个AI模型训练自动化工具,简化了从任务描述到高性能模型的开发流程。该工具利用Claude 3或GPT-4生成数据集,为LLaMA 2或GPT-3.5模型创建系统提示并进行微调。gpt-llm-trainer通过自动化处理复杂的技术细节,使AI模型开发变得更加简单高效,适合快速开发特定任务AI模型的需求。
LLMtuner - 使用 LoRA、QLoRA 等最佳实践对 Llama、Whisper 和其他 LLM 进行微调
GithubLLMTunerLLM微调LlamaLoRAWhisper开源项目
LLMTuner 提供类 scikit-learn 接口,让用户便捷微调如 Llama、Whisper 等大型语言模型。通过 LoRA 和 QLoRA 等技术实现高效微调,内置推理功能和一键启动的交互式 UI,简化模型展示和共享。此外,LLMTuner 还支持未来在 AWS 和 GCP 等平台上的部署。欢迎加入 PromptsLab 社区,探索和讨论最新的开源模型调优技术。
m2 - 子二次GEMM架构Monarch Mixer实现高效语言模型
GithubM2-BERTMonarch Mixer人工智能开源项目机器学习自然语言处理
Monarch Mixer是一种创新的子二次GEMM架构,用于训练序列长度和模型维度均为子二次的语言模型。该架构使用Monarch矩阵层替代Transformer中的注意力和MLP操作,提高了计算效率。基于此架构的M2-BERT模型在减少25%参数和计算量的同时,在GLUE基准测试中达到了与BERT相当的性能。项目开源了预训练模型权重以及预训练和微调代码,方便研究者进行further研究。
Megatron-LM - 优化GPU训练技术 加速大规模Transformer模型
GPU优化GithubMegatron-CoreMegatron-LM分布式训练大语言模型开源项目
Megatron-LM框架利用GPU优化技术实现Transformer模型的大规模训练。其Megatron-Core组件提供模块化API和系统优化,支持自定义模型训练。该项目可进行BERT、GPT、T5等模型预训练,支持数千GPU分布式训练百亿参数级模型,并提供数据预处理、模型评估和下游任务功能。
speculative-decoding - 推测解码技术,优化大型语言模型推理速度
GithubSpeculative Decoding大语言模型开源项目性能优化推理加速自然语言处理
该开源项目聚焦于推测解码技术的研究与实现,旨在提升大型语言模型的文本生成效率。项目涵盖了多种推测解码策略,包括提前退出、推测采样和先知变压器。同时,项目致力于优化批处理推测解码,以增强整体性能。研究计划还包括对比不同策略的效果,并探索微观优化方法。这些工作为加快AI模型推理速度提供了新的技术思路。
PiSSA - 高效微调大语言模型的创新方法
GithubPiSSA低秩适应参数高效微调大语言模型奇异值分解开源项目
PiSSA是一种创新的参数高效微调方法,通过优化关键奇异值和向量来增强大语言模型性能。相较于LoRA,PiSSA展现出更快的收敛速度和更优的效果。在多个基准测试中,PiSSA的表现全面超越LoRA。这种方法不仅保留了LoRA的参数效率和量化兼容性优势,还大幅降低了4位量化误差。PiSSA初始化迅速,易于从LoRA转换。在多种模型和任务中,PiSSA均表现出色,为大语言模型的高效微调提供了新的可能性。
OpenDelta - 高效参数调整的开源工具包
GithubOpenDeltaPyTorchdelta tuningtransformers参数高效微调开源项目
OpenDelta是一个高效的开源调优工具包,通过添加少量参数进行调整,可实现如前缀调优、适配器调优、Lora调优等多种方法。最新版本支持Python 3.8.13、PyTorch 1.12.1和transformers 4.22.2。
PrompTune - 智能提示优化工具 提升沟通效率
AI工具AI辅助PrompTune人工智能提示优化提示工程
PrompTune是一款提示优化工具,利用智能技术分析和改进用户输入。它能快速提升提示质量,适用于多种沟通场景。这个工具旨在帮助用户掌握提示工程技巧,满足现代高效沟通的需求。
LangGPT - 面向大语言模型的结构化提示词设计框架
AIGPTGithubLangGPT开源项目提示词结构化
LangGPT是一个为大语言模型设计的结构化提示词框架,将提示词创作转变为类似面向对象编程的过程。它通过模板、变量和命令,使高质量提示词的创建变得直观高效。LangGPT提供系统化、可适应的方法,帮助用户快速掌握提示词工程技巧,实现大规模生产高质量提示词。这一框架旨在让更多人能够轻松创建出色的提示词,从而更好地发挥大语言模型的潜力。
Awesome-LLM-Prompt-Optimization - 大型语言模型提示词优化技术与研究前沿总览
GithubLLM人工智能开源项目提示优化机器学习自动化
本项目收录了大型语言模型(LLM)提示词优化领域的前沿研究论文。内容涵盖LLM优化、微调、编程、人类反馈、集成学习、强化学习、无梯度方法、上下文学习和贝叶斯优化等多个研究方向。项目旨在为研究人员提供全面的LLM提示词优化资源,助力推动该领域发展。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计 是一个多功能的在线设计和创意平台,提供广泛的设计工具和资源,以满足不同用户的需求。从专业的图形设计师到普通用户,无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑,稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合,帮助用户轻松实现创意设计。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号