TextSnatcher

Linux平台高效图像文字识别工具

TextSnatcher OCR 图像文字识别 Linux应用开源软件 Github 开源项目

TextSnatcher是一款为Linux平台开发的开源OCR工具，基于Tesseract OCR 4.x引擎。它支持多语言识别，能快速从图像中提取文字。用户通过简单拖动即可完成文本复制，操作便捷。TextSnatcher界面友好，适用于日常和工作中的各种文字提取需求。该工具效率高，功能实用，为Linux用户提供了便捷的图像文字识别解决方案。

访问官网

Github

介绍相关项目

OLOCR - 在线多语言OCR文字识别平台支持批量和PDF处理

AI工具OCRPDF处理图像识别在线服务多语言支持

OLOCR是一个免费且无限制的在线OCR文字识别服务平台。支持英文OCR和多种语言的图像转文字及PDF文档识别，提供批量处理功能。可轻松上传图片或PDF文件，实现快速、准确的文本提取。适用于需要大规模文字识别的个人和企业，为文档数字化和信息提取提供便捷解决方案。

ocrs - 基于Rust的开源OCR引擎和命令行工具

GithubOCRONNXRust图像文字提取开源项目机器学习

ocrs是一个基于Rust的开源光学字符识别(OCR)库和命令行工具，利用机器学习技术从各类图像中提取文本。它旨在提供一个现代化的OCR引擎，能够处理多种图像类型，并大幅减少预处理工作。ocrs具有跨平台兼容性，支持WebAssembly，使用开放许可数据集训练。目前项目处于早期阶段，支持拉丁字母识别，并计划未来扩展更多语言支持。

TextIn - 一站式智能文档处理平台，支持多种应用场景

AI工具TextIn合同机器人图像智能处理大模型加速器智能文字识别

TextIn是一个智能文档处理平台，提供OCR文字识别、图像处理、文件转换和大模型加速等功能。支持云端API、端侧SDK和私有化部署，适合企业、开发者及个人用户使用，并可以与OA/ERP等系统无缝对接，提升办公效率，广泛应用于各类文档场景。

simple-ocr-opencv - 基于OpenCV和NumPy的轻量级Python OCR工具

GithubOCROpenCVPython图像识别开源项目机器学习

simple-ocr-opencv是一个基于OpenCV和NumPy的Python OCR工具。它采用矩形模型进行图像分割，使用k-NN算法实现字符分类。项目结构清晰，包含示例代码，支持自定义训练，并提供预标注训练图像和交互式标注功能。开发者可通过example.py快速上手。这个开源项目遵循GNU AGPLv3许可证，适合需要实现基础OCR功能的开发者使用。

BetterOCR - 多个OCR引擎与LLM结合实现高精度文本检测

BetterOCRGithubLLMOCR引擎多语言支持开源项目文本检测

BetterOCR通过结合EasyOCR、Tesseract和Pororo等OCR引擎，并使用LLM技术，解决多语言文本检测难题。支持自定义上下文以提高文本识别的精度，即使是罕见或非传统词汇也能保证高准确性。支持异步操作和改进的界面，并持续快速开发中。欢迎贡献与参与，共同提升OCR技术。

video-subtitle-extractor - 多语言视频字幕批量提取工具，支持GPU加速和多种提取模式

GPU加速GithubOCR识别Video-subtitle-extractor字幕提取开源项目批量提取

Video-subtitle-extractor是一款高效的视频字幕提取工具，可以将视频中的硬字幕提取为外挂字幕文件（srt格式）。支持批量处理、多语言字幕提取和水印去除，适用于Windows、macOS和Linux系统。用户可选择快速、自动或精准模式，使用GPU加速提高提取速度和准确度。本地OCR识别无需连接在线服务，适合对字幕提取有高要求的用户。

LaTeX-OCR - 智能数学公式图像转LaTeX代码工具

GithubLaTeX识别pix2tex图像处理开源项目数学公式机器学习

这是一个基于机器学习的系统，可以将数学公式图像转换为相应的LaTeX代码。系统支持命令行工具、图形用户界面、API和Python集成，提供多种使用方式。适用于不同分辨率的图像，自动优化处理以提高识别性能。还包括模型训练指南和数据集生成工具，适用于科研和教育用途。

tesseract-ocr-for-php - 用于PHP的Tesseract OCR封装库

GithubPHPTesseract OCR图像识别多语言支持开源库开源项目

tesseract-ocr-for-php是一个PHP封装库，提供简洁的接口调用Tesseract OCR引擎。该库支持多语言文字识别、自定义配置和多种输出格式(如HOCR、PDF)。适用于文档数字化、图像文字提取等OCR应用场景。通过Composer可快速集成到PHP项目中，简化OCR开发流程。

ExtractThinker - 使用 LLM 从文件和文档中提取数据的库

ExtractThinkerGithubLLMs开源项目数据提取文档处理智能文档

ExtractThinker提供智能文件数据提取，支持Tesseract OCR、Azure Form Recognizer和AWS TextExtract等多种文档加载器。适用于异步处理、多种格式和ORM风格操作的模块化架构，并与LangChain生态系统兼容。专注于智能文档处理，大幅提升数据提取准确率，适用于发票、驾照等多场景。

MORT - 多语言屏幕实时OCR和翻译工具

GithubMORTOCR多语言支持实时翻译开源项目机器翻译

MORT是一款开源的屏幕实时OCR和翻译工具，支持从屏幕提取文本并进行实时翻译。它集成了多种OCR引擎如TesseractOCR、Windows OCR等，以及Papago、Google等翻译服务。MORT具备多区域OCR、图像调整和自定义API等功能，可应用于游戏、视频等场景的实时翻译。该工具支持英语和日语的默认提取与翻译，并可通过剪贴板功能与钩子程序联动。

相关项目

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具，简化了选题、文献检索至论文撰写的整个过程。通过简单设定，平台可快速生成高质量论文大纲和全文，配合图表、参考文献等一应俱全，同时提供开题报告和答辩PPT等增值服务，保障数据安全，有效提升写作效率和论文质量。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号