Project Icon

intel-extension-for-transformers

提升GenAI与LLM模型性能的先进工具包

Intel® Extension for Transformers是专为提升基于Transformer架构的GenAI/LLM模型而设计的先进工具包。本工具包支持多种平台,如Intel Gaudi2、CPU和GPU,并整合了Hugging Face transformers APIs与Intel® Neural Compressor,提供顺畅的模型压缩过程和多样化的优化选择。此外,工具包含可定制的NeuralChat聊天机器人框架,为用户带来高效的AI交互体验。

项目介绍

背景概述

Intel® Extension for Transformers 是一款创新的工具包,旨在通过Transformer模型优化性能,提升生成式AI(GenAI)和大型语言模型(LLM)在不同Intel平台上的加速表现。该工具包支持Intel Gaudi2、Intel CPU和Intel GPU等平台,为用户提供了无缝的模型压缩体验。

主要功能

模型压缩和优化

Intel® Extension for Transformers 扩展了 Hugging Face transformers 的API,并利用Intel® Neural Compressor,提供模型压缩功能。它包含先进的软件优化和独特的压缩感知运行时,具有提升CPU上Transformer模型性能的功能。

模型和工作流支持

该工具包优化了多种基于Transformer模型的程序包,例如Stable Diffusion、GPT-J-6B及BLOOM-176B等,并支持从文本到图像转换、文本生成与总结等应用。此外,还提供了SetFit文本分类和文档级别的情感分析等工作流实例。

自定义聊天机器人

你可以使用NeuralChat框架创建定制化聊天机器人。通过丰富的插件集成,如知识检索、语音交互及安全防护等,NeuralChat框架支持在Intel Gaudi2、CPU和GPU上运行。

大语言模型推理

工具包支持在Intel CPU和GPU上进行大语言模型的推理,兼容不同的指令集,从而提高了4代Intel Xeon可扩展处理器的性能。

最新进展

近年来,Intel® Extension for Transformers 项目取得了多项突破:

  • 支持Meta Llama 3的发布,与Intel AI解决方案共同加速。
  • 在Intel的Meteor Lake平台上支持INT4推理。
  • 比较3.1版本,在5代Xeon的MLPerf v4.0提交中,GPT-J推理性能提高1.8倍。
  • 支持在Intel Data Center GPU Max系列和Intel Arc A系列GPU上的INT4推理。

验证设备与软件

该工具包已在多种Intel硬件平台上验证,包括但不限于Intel Gaudi2、Xeon可扩展处理器及Intel Core处理器,涵盖了全精度和低位推理支持。在软件方面,包括对各种版本的PyTorch、Intel® Extension for PyTorch和Transformers的兼容性验证。

入门指南

Intel® Extension for Transformers 提供了多样的实例和教程帮助用户快速上手。例如,用户可以通过简单的代码创建自己的聊天机器人,或使用扩展API实现低位推理。此外,利用Langchain扩展API,用户还可以进行检索问答的应用开发。

扩展阅读

项目提供了丰富的文档资源和教程,帮助用户深入理解和应用这些工具。例如:

  • Chatbot部署教程:有关在Intel CPU、GPU上部署聊天机器人的详细说明。
  • 模型压缩技术文档:包括平滑量化、权重量化和QLoRA等。
  • 一系列博客文章与演示视频,展示了Intel平台上AI工具的性能和应用场景。

贡献与合作

欢迎对模型压缩技术和基于LLM的聊天机器人开发有兴趣的开发者们提出想法。Intel期待与大家的合作,为Transformer模型的扩展和应用做出贡献。

Intel® Extension for Transformers不仅在学术界发表了多篇有关高效自然语言处理的论文,还在一系列国际科技活动中展示了其最新成果,进一步推动了AI技术的发展。通过与开源项目的合作,该工具包不断进步和优化,以适应不断变化的人工智能技术需求。

项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号