Project Icon

robotic-transformer-pytorch

RT1机器人控制Transformer模型的PyTorch实现

本项目是Google Robotics团队RT1(Robotic Transformer)的PyTorch实现版本。RT1是一个结合视觉和自然语言处理的机器人控制Transformer模型。该实现包含MaxViT视觉主干网络和RT1核心模型,支持视频输入和文本指令处理。项目提供简洁API,实现了条件采样和跨注意力等功能,可应用于多种机器人控制场景。

Transformer-from-scratch - 简洁实现Transformer模型的入门教程
GithubLLMPyTorchTransformer开源项目模型训练自然语言处理
该项目展示了如何用约240行代码实现Transformer模型,包含基于PyTorch的训练演示和详细的Jupyter Notebook。使用450Kb样本数据集,在单CPU上20分钟内完成训练,帮助初学者理解大型语言模型的原理和实现过程。
reptile-pytorch - PyTorch实现的用于监督学习的OpenAI Reptile算法
GithubMiniImagenetOmniglotOpenAIPyTorchReptile开源项目
PyTorch实现的OpenAI Reptile算法,专注于监督学习,目前支持在Omniglot数据集上运行,具备K-shot N-way采样、训练监控和中断恢复功能。欢迎对项目的贡献和反馈,未来计划支持Mini-Imagenet数据集、提升Meta-batch大小、添加训练曲线和Shell脚本下载功能。
Multi-Task-Transformer - 场景理解多任务变压器模型 TaskPrompter和InvPT
GithubTransformer场景理解多任务学习开源项目深度学习计算机视觉
Multi-Task-Transformer项目提供两种场景理解多任务变压器模型:TaskPrompter和InvPT。TaskPrompter利用空间-通道多任务提示进行密集场景理解,InvPT采用倒金字塔架构。这些模型在单目深度估计和3D目标检测等任务中表现出色,并在ICLR2023和ECCV2022会议上发表。项目开源代码和预训练模型,支持多种计算机视觉应用。
other - 高性能开源自然语言处理框架
GithubHuggingfacetransformers人工智能开源项目机器学习模型深度学习自然语言处理
Transformers是一个开源的自然语言处理框架,提供多种预训练模型和工具。支持文本分类、问答和生成等任务,适用于研究和生产环境。该框架易用且灵活,可处理多语言文本,支持迁移学习。Transformers定期更新,紧跟NLP领域最新进展,为用户提供丰富的API和优化的性能。
magvit2-pytorch - MagViT2视频生成和理解模型的PyTorch开源实现
AI模型GithubMagViT2Pytorch实现开源项目视频生成语言模型
MagViT2是基于语言模型的最新视频生成和理解技术。该PyTorch实现提供高效视频标记器和训练器,支持大规模数据集。项目包含无查找量化器,适用于多种模态。灵活架构设计允许自定义层和注意力机制,为研究人员提供探索和改进视频生成技术的工具。
TransMorph_Transformer_for_Medical_Image_Registration - 基于Transformer的无监督医学图像配准方法
GithubPyTorchTransMorphTransformer医学影像配准开源项目深度学习
TransMorph是一个利用Transformer架构进行无监督医学图像配准的开源项目,结合了Vision Transformer和Swin Transformer技术。提供多个模型变体和多种损失函数,支持单模态和多模态配准,公开了训练脚本和预训练模型,并在MICCAI 2021 L2R挑战中表现出色。
parti-pytorch - Google Parti模型的PyTorch实现 基于注意力的文本到图像生成
GithubPartiPytorch开源项目文本到图像生成深度学习计算机视觉
本项目是Google Parti模型的PyTorch实现,Parti是一种基于纯注意力机制的文本到图像生成神经网络。项目包含ViT VQGan VAE训练代码和视觉Transformer的优化,提高了训练效率。实现了简便的安装和使用流程,支持条件生成和分类器引导。这为研究人员和开发者提供了探索和改进文本到图像生成技术的平台。
transformers - 免费开源的transformers课程,详解关键概念与实践操作
BERTGithubtransformers多头注意力机制开源项目自注意力机制课程
该课程由软件工程师Peter发起,现正免费且开放源码。内容涵盖transformers的关键概念、实践练习和学术论文剖析。通过YouTube视频讲解和Jupyter笔记本实操,深入学习编码器-解码器架构、自注意力、多头注意力等核心概念,并从零开始构建简单的transformer模型。亦包含如何微调BERT和GPT-2等预训练模型及进行特定任务处理和文本生成。
AiLearning-Theory-Applying - 人工智能领域的全面学习资源
AiLearning-Theory-ApplyingGithubTransformer开源项目机器学习深度学习自然语言处理
AiLearning-Theory-Applying项目提供人工智能领域的全面学习资源,覆盖基础知识、机器学习、深度学习及自然语言处理。项目持续更新,附带详尽注释和数据集,便于理解与操作,助力初学者及研究人员迅速掌握AI理论及应用实践。
CoCa-pytorch - CoCa模型的PyTorch开源实现
CoCaGithubPytorch实现transformer架构图像文本模型对比学习开源项目
CoCa-pytorch项目提供了CoCa(Contrastive Captioners)模型的PyTorch实现。该项目将对比学习融入传统的编码器/解码器transformer,优化了图像到文本的转换。项目采用PaLM的transformer架构,包含单模态、多模态transformers和交叉注意力模块。这一实现为研究和开发图像-文本基础模型提供了有力工具。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

白日梦AI

白日梦AI提供专注于AI视频生成的多样化功能,包括文生视频、动态画面和形象生成等,帮助用户快速上手,创造专业级内容。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

讯飞绘镜

讯飞绘镜是一个支持从创意到完整视频创作的智能平台,用户可以快速生成视频素材并创作独特的音乐视频和故事。平台提供多样化的主题和精选作品,帮助用户探索创意灵感。

Project Cover

讯飞文书

讯飞文书依托讯飞星火大模型,为文书写作者提供从素材筹备到稿件撰写及审稿的全程支持。通过录音智记和以稿写稿等功能,满足事务性工作的高频需求,帮助撰稿人节省精力,提高效率,优化工作与生活。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号