#OCR

GoSseract：基于Tesseract的Go语言OCR库

2024年09月05日

gosseract OCR Tesseract Go语言图像识别 Github 开源项目

2024年09月05日

TextRecognitionDataGenerator: 生成合成文本识别数据的强大工具

2024年09月05日

TextRecognitionDataGenerator OCR 图像生成文本识别合成数据 Github 开源项目

2024年09月05日

Tessdata:Tesseract OCR引擎的语言训练数据

2024年09月05日

Tesseract OCR 语言数据 LSTM模型 tessdata Github 开源项目

2024年09月05日

PanelCleaner: AI驱动的漫画对话框清理工具

2024年09月05日

Panel Cleaner 机器学习文本检测图像处理 OCR Github 开源项目

2024年09月05日

Text Grab: 一款强大的OCR文字识别工具

2024年09月05日

文本提取 OCR Windows应用文本编辑快速查找 Github 开源项目

2024年09月05日

NAPS2: 简单易用的开源文档扫描软件

2024年09月05日

NAPS2 文档扫描 PDF OCR 跨平台 Github 开源项目

2024年09月05日

Comic Translate: 革命性的自动漫画翻译工具

2024年09月05日

Comic Translate OCR 翻译语言模型人工智能 Github 开源项目

2024年09月05日

Texify: 革命性的数学公式识别与转换工具

2024年09月05日

Texify OCR LaTeX 图像转换机器学习 Github 开源项目

2024年09月05日

大型OCR模型的扩展法则研究及其在多模态大模型中的应用

2024年09月05日

OCR 大型模型多模态视觉问答缩放法则 Github 开源项目

2024年09月05日

TexTeller: 高精度图像转LaTeX公式解决方案

2024年09月05日

TexTeller 公式识别 OCR 机器学习图像处理 Github 开源项目

2024年09月05日

相关项目

layout-parser

LayoutParser提供多种深度学习模型和统一API，简化文档图像分析任务。支持布局检测、OCR、数据可视化等功能，并允许共享模型和分析流程。安装简便，可根据需求选择依赖项，是文档图像处理的理想工具。

PaddleOCR

PaddleOCR旨在为开发者提供一套丰富、领先且实用的OCR工具库，帮助开发者快速训练并部署OCR模型。它不仅支持中英文识别，还支持多语言和多硬件平台，包括最新的PP-OCRv4模型，有效提高了中英文场景下的识别精确度。适用于移动端和服务器端，适配多种开发需求。

LARS

LARS是一个开源应用，允许在本地设备运行大型语言模型（LLM），支持上传个人文件，以及通过检索增强生成（RAG）技术增强对话准确度和减少生成误差。特点包括精确文献引用、多种文件格式支持、全历史聊天记录和GPU加速。用户可以自定义LLM设置，优化使用体验。

sparrow

Sparrow是一个开源解决方案，专注于高效从各类文档和图像中提取与处理数据。它通过模块化架构提供独立的服务和优化的流程，支持表格、发票、收据等非结构化数据源。Sparrow的API支持本地语言模型数据提取，可与自定义工作流程集成。

Bob

Bob为macOS用户提供全方位的翻译与OCR解决方案，支持文本、截图、输入及OCR翻译等多样化功能。整合了主流翻译引擎，如Google翻译和腾讯翻译君，确保准确快速地完成翻译任务。其高效的OCR技术，适用于多种应用场景，简化了文本识别过程。Bob的简洁界面和强大功能，使其成为提升Mac用户工作效率的优选工具。

Easydict

Easydict是专为macOS开发的词典翻译工具，提供词汇查找、全文翻译和OCR识别功能。整合了多种翻译平台，包括有道、苹果系统词典和Google。涵盖48种语言，并配备自动语种识别与智能查询，实现便捷高效的翻译体验。

llm_aided_ocr

该系统利用自然语言处理、机器学习和智能文本处理技术，将OCR输出的文本转换为高精度、格式化良好的易读文档。它解决了字符识别错误、段落结构不正确、虚构内容和格式不一致等常见OCR问题。支持从PDF到图像的转换，使用Tesseract进行OCR，并提供通过本地或API接口进行高级错误校正、智能文本分块处理和Markdown格式化等功能。此外，还采用FAISS和嵌入相似性检查进行内容过滤，确保输出文本的质量和一致性。

AutoNode

AutoNode 是一种自操作计算机系统，专注于实现网页交互和数据提取的自动化。它使用光学字符识别（OCR）和 YOLO 模型进行对象检测，结合自定义站点图来程序化地导航和操作网页。只需安装 Python 和 Docker，配置站点图并使用 API，即可轻松完成高效的网页自动化任务。AutoNode 还支持远程托管 YOLO 和 OCR 模块，适合本地资源有限的环境。

EasyOCR

EasyOCR是一款支持80多种语言和主要书写系统（如拉丁文、中文、阿拉伯文等）的光学字符识别（OCR）工具。它提供简单的安装和使用指南，帮助快速实现文本检测与识别，适用于多种场景。最新版本增加了Apple Silicon支持并修复了兼容性问题。未来版本将支持手写文本识别，进一步增强其功能。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com