Project Icon

NATTEN

高效实现多维滑动窗口自注意力的开源库

NATTEN是一个开源库,专门用于快速实现Neighborhood Attention。该项目支持1D、2D和3D问题空间,提供naive、GEMM以及新型Fused Neighborhood Attention (FNA)等多种后端实现。FNA引入反向传播支持,显著提高了模型训练效率。NATTEN兼容PyTorch 2.0及更高版本,同时支持CPU和CUDA后端,并实现了因果掩码、可变参数和相对位置偏置等功能。

returnn - 多GPU优化的Theano/TensorFlow循环神经网络框架
GithubLSTMRETURNN多GPU环境开源项目神经网络训练速度
RETURNN是一个基于Theano和TensorFlow的现代循环神经网络框架,优化于多GPU环境下的快速可靠训练。其主要特点包括简便的配置与调试、支持多种实验模型,以及高效的训练和解码速度。项目还支持小批量训练、序列分块训练、长短期记忆网络、多维LSTM和大数据集内存管理,广泛应用于机器翻译和语音识别领域。RETURNN提供详尽的文档和使用教程,并通过StackOverflow标签提供社区支持。
dynet - 动态结构神经网络库 适用于自然语言处理
DyNetGithub动态神经网络开源项目深度学习神经网络库自然语言处理
DyNet是一个专为动态结构神经网络设计的开源库,由卡内基梅隆大学主导开发。该库采用C++编写并提供Python接口,可在CPU和GPU上高效运行。DyNet特别适用于自然语言处理任务,在语法分析和机器翻译等领域表现突出。其独特的自动批处理功能进一步提升了处理动态网络的效率。
CustomNet - 创新的物体定制与多视角生成扩散模型
CustomNetGithub对象定制开源项目文本生成图像深度学习视角控制
CustomNet是一个创新的文本到图像扩散模型框架,专注于物体定制和多视角生成。该模型整合了3D新视角合成能力,实现物体空间位置和视角的灵活调整,同时保持物体身份。CustomNet无需测试时优化,可同时控制视角、位置和文本,在身份保持、多样性和协调性方面表现出色。这一技术为物体定制和图像生成领域开辟了新的可能性。
Renate - 自动神经网络再训练的持续学习解决方案
GithubPyTorchRenate开源项目持续学习模型重训练神经网络
Renate是一个用于神经网络模型自动再训练的Python库,采用持续学习和终身学习算法。基于PyTorch和Lightning构建,通过Syne Tune实现超参数优化。该工具专门解决数据分布变化引起的灾难性遗忘问题,提升模型对新数据的适应能力。Renate支持云端部署,适合实际再训练场景,并提供便捷的高级超参数优化功能。
NEFTune - 革新语言模型指令微调的噪声嵌入技术
GithubLLM微调NEFTune噪声增强嵌入向量开源项目性能提升
NEFTune是一种创新的语言模型指令微调技术,通过向嵌入向量添加随机噪声来提升模型性能。这种方法无需额外计算资源或数据,却能显著改善对话质量。在AlpacaEval评估中,NEFTune将LLaMA-2-7B模型的性能从29.8%提升至64.7%。作为一种高效的LLM微调方案,NEFTune为模型优化提供了低成本、高收益的解决方案。
based - 结合短窗口和线性注意力的高效语言模型架构
BasedGithub召回开源项目效率线性注意力语言模型
Based是一种创新的语言模型架构,结合短窗口注意力和全局线性注意力,实现次二次复杂度的高效依赖建模。该模型在多项基准测试中表现优异,尤其擅长需要长程记忆的任务。项目提供预训练模型、训练评估代码和合成数据实验,展示了其在召回与吞吐量平衡方面的优势。研究人员可利用这些资源深入探索和优化这一新型语言模型架构。
swin-base-patch4-window7-224-in22k - 基于shifted windows的分层视觉Transformer图像处理模型
GithubHuggingfaceSwin Transformer图像分类图像识别开源项目模型深度学习计算机视觉
Swin Transformer是一个在ImageNet-21k数据集上预训练的视觉模型,通过shifted windows机制实现局部特征提取,降低计算复杂度。模型采用分层特征图构建和局部注意力计算方式,适用于图像分类和密集识别任务,计算复杂度与输入图像大小呈线性关系
gen-efficientnet-pytorch - 泛型EfficientNet和其它高效PyTorch模型的实现
EfficientNetGithubMixNetMobileNetPyTorch开源项目模型
本项目实现了EfficientNet、MixNet、MobileNetV3等多种高效模型,利用通用架构定义支持多种计算高效的神经网络。所有模型均基于MobileNet V1/V2块序列设计,并支持字符串化架构配置。请注意,该项目现已停止维护,推荐使用`timm`库获取更多功能和权重兼容的模型。
1 - 开源自然语言处理工具库提升文本处理效率
AI模型GithubHuggingfacetransformers开源项目机器学习模型深度学习自然语言处理
transformers是一个开源自然语言处理工具包,旨在通过简化模型训练和应用,提升机器学习项目的效率。该库提供丰富功能和预训练模型,便于执行各种文本分析和生成任务。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号