surya_tablerec

基于transformers的高效表格识别模型提升文档分析效率

transformers Huggingface 模型表格识别 Github 开源项目 surya

surya_tablerec是一个基于transformers库的开源表格识别模型，专为surya项目开发。该模型能够识别和提取文档中的表格结构，适用于处理各种复杂的表格布局。surya_tablerec可帮助研究人员和数据分析师从大量文档中快速提取表格信息，提高文档分析效率。该项目采用CC-BY-NC-SA-4.0许可证，可用于非商业用途。

Github

Huggingface

介绍相关项目

trocr-small-handwritten - Transformer架构的手写文本识别OCR模型

GithubHuggingfaceTrOCRTransformer模型光学字符识别图像转文本开源项目手写识别模型

TrOCR-small-handwritten是一个基于Transformer架构的手写文本识别模型。它结合图像编码器和文本解码器，可将手写图像准确转换为文本。该模型在IAM数据集上微调，适用于单行文本OCR任务。模型提供简洁API，便于集成到各类应用中，实现高效的手写文本数字化。其小型结构设计使其在保持识别精度的同时，具有更快的处理速度和更低的资源消耗。

deep-text-recognition-benchmark - 基于深度学习方法的文本识别

GithubPyTorch场景文本识别开源项目数据集模型分析深度学习

该项目是一个开源的场景文本识别框架，通过四阶段的官方PyTorch实现，支持现有大多数STR模型。它允许在统一的数据集上，评估各个模块的性能表现，包括准确性、速度和内存需求，并已被多个国际竞赛验证。用户可使用预训练模型进行测试，或进行更深入研究。

subnet9_track2_3 - Transformers模型卡片 AI模型信息概览

GithubHugging FaceHuggingfaceTransformers开源项目机器学习模型模型卡自然语言处理

Transformers模型卡片是一种标准化文档，汇总了AI模型的关键信息。它涵盖了模型的基本属性、应用场景、潜在风险、训练过程和评估结果等方面。通过提供模型架构、数据来源和环境影响等详细信息，模型卡片增强了AI系统的透明度和可解释性，有助于用户更好地理解和应用这些模型。

transformers_tasks - 多种集成NLP任务的高效开源工具

GithubNLPhuggingface transformers信息抽取开源项目强化学习文本匹配

transformers_tasks提供了多种NLP任务的实现，基于Huggingface transformers库，用户可以便捷加载及训练模型，并根据自己数据集进行微调。包括文本匹配、信息抽取、Prompt任务等多种功能，适用于Python 3.6+和多种操作系统，满足不同NLP应用需求。

sycamore - AI文档处理与数据抽取

Aryn Partitioning ServiceDETR AI modelGithubSycamore开源项目文档处理引擎矢量数据库

Sycamore是一个开源的AI文档处理引擎，针对ETL、RAG和LLM应用。它具备处理和丰富各类文档（如报告、幻灯片和手册）的能力，特别在PDF和嵌入图表的图像处理上表现优异。借助Aryn Partitioning Service，Sycamore实现了高效的文档分割、OCR和数据提取，极大提升了数据块分割准确性和检索效果。其DocSet抽象模型支持大规模数据处理，包括表格提取和视觉摘要，确保高质量数据可以轻松载入向量数据库和混合搜索引擎。

Table Ninjia - AI驱动的PDF和图像表格数据提取解决方案

AI工具AI技术PDF处理图像处理表格提取表格检测

Table Ninjia专门用于从PDF和图像中提取表格（extract table from pdf and image）。该在线工具运用先进的AI技术，能够从PDF文档和图像中精准识别并提取表格数据，将其转换为CSV格式。Table Ninjia自动检测表格位置和结构，有效解决了手动提取耗时且易错的问题。对于复杂PDF文档或图像中的表格，该工具都能高效完成提取任务，大幅提升数据处理效率，为用户节省大量时间和精力。

v3_1_pt_ep1_sft_5_based_on_llama3_1_70b_final_data_20241026 - 揭示新型Transformer模型的实际应用与研究进展

GithubHuggingfacetransformers偏见开源项目模型模型卡环境影响评估

该文档介绍了新型Transformers模型的功能、应用领域与局限性，包含使用指南、训练数据概述、程序步骤、评估方法及其环境影响评估，为读者提供全面的信息参考。

NVTabular - GPU加速的大规模表格数据特征工程库

GPU加速GithubNVTabular开源项目推荐系统数据预处理特征工程

NVTabular是NVIDIA Merlin框架的组件，用于处理TB级数据集和训练深度学习推荐系统。该库利用GPU加速计算，提供高级抽象以简化代码。它可处理超出内存限制的大规模数据集，使数据科学家专注于数据操作，快速准备实验数据，并加速生产模型的数据转换过程。

deepdoctection - 文档AI：基于深度学习的提取与布局分析工具包

GithubOCRdeepdoctection开源项目文档AI模型深度学习

deepdoctection是一个Python库，通过深度学习模型实现文档提取和布局分析，支持对象检测、OCR和文本挖掘。此集成框架结合Tensorflow或PyTorch等库，适用于PDF或扫描图片文档处理，支持文档布局分析、表格识别和文本分类等任务，致力于解决实际应用问题，是文档处理领域开发者的理想选择。

transformer-models - MATLAB深度学习变换器模型实现库

BERTGithubMATLABTransformer开源项目深度学习自然语言处理

该项目提供MATLAB环境下的多种深度学习变换器模型实现，包括BERT、FinBERT和GPT-2。支持文本分类、情感分析、掩码标记预测和文本摘要等自然语言处理任务。项目特点包括预训练模型加载、模型微调、详细示例和灵活API，可用于研究和实际应用。

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号