gmft
gmft是一个开源的PDF表格提取库,采用微软Table Transformers技术实现高质量表格识别和结构化。支持Pandas dataframe等多种输出格式,无需GPU即可高速运行。gmft依赖少、安装简单,提供模块化设计和灵活配置,在多种表格提取方案对比中表现优异。