Project Icon

awesome-decision-transformer

基于序列模型的离线强化学习新方法

Decision Transformer (DT)是一种将离线强化学习转化为条件序列建模的创新方法。本项目收集了DT相关研究论文,涵盖多智能体系统、安全强化学习、多任务学习等应用领域。通过持续追踪DT的前沿进展,为研究人员提供全面的资源,促进这一算法在各个领域的发展和应用。

dit-base-finetuned-rvlcdip - 基于自监督学习的文档图像转换模型应用
Document Image TransformerGithubHuggingfaceRVL-CDIP开源项目文档分类模型自我监督学习视觉编码器
Document Image Transformer 是一种基于 Transformer 的模型,专为自监督学习而设计,通过大量文档图像来学习图像的内在表示。经过 RVL-CDIP 数据集的细调,该模型适用于文档图像分类、表格检测和文档布局分析等任务。通过在预训练编码器上添加线性层,可以灵活实现不同任务的目标。模型将图像划分为16x16像素固定块,并使用离散 VAE 编码器的视觉 token 进行预测。该技术解决方案在灰度图像分类中表现出色,尤其是在细分类别的文档图像任务中。
llm-paper-notes - 大语言模型论文笔记集锦 追踪AI研究前沿进展
GithubTransformer人工智能大语言模型开源项目自然语言处理论文笔记
该项目汇集了大语言模型领域的关键论文笔记。内容涵盖Transformer架构、注意力机制、预训练方法、缩放法则和检索增强生成等核心主题。通过精炼总结,为研究者和开发者提供LLM领域的核心概念和最新进展概览,便于快速了解AI前沿研究动态。
recurrent-memory-transformer-pytorch - Recurrent Memory Transformer的PyTorch实现助力超长序列处理
GithubPyTorchRecurrent Memory Transformer人工智能开源项目深度学习自然语言处理
Recurrent Memory Transformer的PyTorch实现项目致力于解决超长序列处理问题。该模型通过创新的记忆机制和高效注意力机制,可处理长达百万token的序列。项目提供简便的安装使用方法,支持XL记忆和记忆回放反向传播等先进功能。这一实现在长序列处理、因果推理和强化学习等领域展现出优异性能,为AI研究和应用开发提供了实用工具。
table-transformer-structure-recognition-v1.1-all - Table Transformer开源表格结构识别模型
GithubHuggingfaceTable Transformer开源项目文档分析模型深度学习表格识别计算机视觉
Table Transformer是一个开源的表格结构识别模型,基于DETR架构设计。该模型在PubTables1M和FinTabNet.c数据集上进行了预训练,采用'normalize before'设置优化了网络结构。Table Transformer能够准确检测文档中的表格,为表格结构分析提供了有力支持。项目提供了详细文档,便于研究人员和开发者进行深入研究和实际应用。
Awesome-Parameter-Efficient-Transfer-Learning - 精选计算机视觉和多模态领域的高效参数迁移学习论文
AdapterComputer VisionGithubMultimodalParameter-Efficient Transfer LearningPrompt开源项目
本项目收录了关于计算机视觉和多模态领域的高效参数迁移学习的优秀论文。参数高效迁移学习通过修改尽可能少的参数,使得大规模预训练模型能够更好地适应各种下游任务,降低全微调带来的过拟合风险和高成本。内容包括Prompt、Adapter和Unified等方法的研究论文,是学术研究与应用开发的理想参考资源。
repeat - 开源自然语言处理库
GithubHuggingfacetransformers人工智能开源项目机器学习模型深度学习自然语言处理
Transformers是一个开源的自然语言处理库,提供了多种预训练模型和工具。该库支持文本分类、命名实体识别和机器翻译等任务,具有良好的文档支持和定期更新特性。研究人员和开发者可以使用Transformers构建和部署NLP应用。
simple-hierarchical-transformer - 分层Transformer模型探索多层次预测编码
GithubTransformer开源项目注意力机制深度学习神经网络自然语言处理
这个项目提出了一种在GPT模型中实现多层次预测编码的方法。它通过在Transformer中引入多层结构,结合局部注意力和全局信息传递。实验结果显示,该方法在维持性能的同时提升了效率。项目允许自定义层次结构、维度和注意力窗口大小,为研究人员提供了探索分层Transformer的实验工具。项目代码支持灵活配置,包括调整层次数量、模型维度和注意力窗口大小。这种设计使研究人员能够方便地进行不同参数的对比实验,有助于深入理解分层Transformer的性能特点。
table-transformer-structure-recognition - Table Transformer表格结构识别模型
DETRGithubHuggingfaceTable Transformer对象检测开源项目模型深度学习表格识别
Table Transformer是一个基于DETR架构的表格结构识别模型,在PubTables1M数据集上微调。它能有效检测表格中的行、列等结构元素,适用于非结构化文档中的表格提取。这个开源模型可用于改进文档分析和信息提取流程。作为一种先进的图像识别和机器学习技术,Table Transformer为表格结构识别任务提供了新的解决方案。
awesome-efficient-aigc - AIGC效率优化技术与资源汇总
AIGCGithubLLM开源项目模型压缩量化高效推理
该项目汇集了提高AI生成内容(AIGC)效率的最新技术资源,包括大语言模型(LLMs)和扩散模型(DMs)的优化方法。收录内容涵盖前沿研究论文、代码实现和综述文章,重点关注量化、微调等效率提升技术。这一持续更新的资源库为AIGC领域的研究和开发提供了全面的参考,有助于推动相关技术的进步与落地应用。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号