MORT

多语言屏幕实时OCR和翻译工具

MORT OCR 实时翻译机器翻译多语言支持 Github 开源项目

MORT是一款开源的屏幕实时OCR和翻译工具，支持从屏幕提取文本并进行实时翻译。它集成了多种OCR引擎如TesseractOCR、Windows OCR等，以及Papago、Google等翻译服务。MORT具备多区域OCR、图像调整和自定义API等功能，可应用于游戏、视频等场景的实时翻译。该工具支持英语和日语的默认提取与翻译，并可通过剪贴板功能与钩子程序联动。

访问官网

Github

介绍相关项目

Umi-OCR_v2 - 开源多语言OCR软件支持批量处理和自定义识别

GithubUmi-OCR仓库迁移开源项目版本更新项目重构

Umi-OCR是一款开源的光学字符识别软件，支持多语言识别、批量处理和自定义识别区域。项目已完成v2版本重构并发布2.0.0正式版，迁移至主仓库继续更新。Umi-OCR作为长期项目，将持续优化识别精度和用户体验。

tools-ocr - Tree Hole OCR 高效本地文本识别工具

GithubPDF识别Tree Hole OCR开源项目文本识别本地OCR识别跨平台兼容

Tree Hole OCR是一款基于Paddle OCR模型的本地文本识别工具。无需联网即可快速识别文字，支持PDF、图像和截图识别等多种功能。采用Java和JavaFX开发，具有良好的跨平台兼容性，适用于Mac OS X 12.6及以上系统。该工具依赖于DJL、PyTorch等深度学习框架，集成了OpenCV图像处理库。除基本文本识别外，还支持PDF识别和快捷键截图识别。项目开源，可在GitHub或Gitee上获取源码。

Image to Text Converter - 将图片转换为可编辑文本的多功能OCR工具

AI工具OCR技术图像转文本多语言支持数据安全文字提取

这款在线OCR工具能够快速准确地从图片中提取文字。支持多种图片格式和多语言识别，可一次上传多张图片。界面友好且完全免费，无需注册。广泛应用于教育、研究和数据输入等领域，提高工作效率。用户只需上传图片并点击转换，即可获取可编辑的文本内容。

mmocr - 一个基于 PyTorch 和 mmdetection 的用于文本检测、文本识别以及相应的下游任务，包括关键信息提取的开源工具箱

GithubMMOCROpenMMLabPyTorch开源项目文本检测文本识别

MMOCR是一个基于PyTorch和mmdetection的开源工具箱，提供全面的文本检测、文本识别及信息提取解决方案。它支持多种先进模型和模块化设计，允许用户自定义优化器、数据预处理和模型组件。最新版本v1.0.0新增支持SCUT-CTW1500、SynthText和MJSynth数据集，更新了FAQ和文档，并添加了新教程笔记本。适用于PyTorch 1.6+，欢迎研究人员和开发者贡献改进。

crow-translate - 多功能轻量级翻译软件支持多种翻译API

Crow TranslateGithub开源项目翻译软件语音转换跨平台

Crow Translate是一款跨平台翻译工具,集成了多种在线翻译API。软件具有文本翻译、语音朗读、OCR识别等功能,同时提供命令行和D-Bus接口。它支持125种语言,运行占用内存小,适用于Linux和Windows系统。

GrabText - 多功能OCR识别与手写数学公式转换平台

AI工具OCR技术手写识别文字识别文本导出自动校正

GrabText提供免费在线OCR和图像文本识别服务，专注于手写文本和数学公式的精准转换。支持多种输出格式，包括txt、LaTeX、doc和pdf。用户只需上传图片，系统即可自动进行文本识别、拼写和语法校正。借助ChatGPT功能，GrabText进一步优化了文本处理的准确度和智能化水平。这一强大的图像转文本工具适用于学生、研究人员和各行业专业人士，为文字处理提供便捷高效的解决方案。无论是在线OCR、手写识别还是数学公式转换，GrabText都能满足您的需求。

normcap - 跨平台OCR截图工具智能提取文本信息

GithubNormCapOCR开源开源项目截图工具跨平台

NormCap是一款基于OCR技术的屏幕截图工具，适用于Linux、macOS和Windows系统。这款开源软件不仅可以捕获图像，还能智能识别并提取图像中的文本信息。NormCap支持多语言识别，界面简洁易用。无论是日常办公还是学术研究，NormCap都能协助快速获取所需的文字内容，提高工作效率。

GOT-OCR2_0 - GOT-OCR2_0为OCR技术开创统一端到端模型新纪元

GOTGithubHuggingfaceOCR图像识别开源项目模型自然语言处理视觉语言模型

GOT-OCR2_0项目提出通用OCR理论，通过统一端到端模型实现OCR 2.0。该模型具备多语言识别、版面分析和细粒度OCR能力，可处理普通文本、格式化文本及多页文档。项目提供开源训练代码和在线演示，为OCR技术发展开辟新方向。

Easy-Translate - 高效多语言文本翻译工具支持多种模型

Easy-TranslateGithub多语言翻译大规模语言模型开源项目机器翻译自然语言处理

Easy-Translate是一款适合各级用户的文本翻译工具，支持M2M100、NLLB200和SeamlessM4T等多种翻译模型。该工具可在不同硬件环境下运行，具备自动调整批处理大小、多种解码策略和加载大型模型等功能。此外，Easy-Translate还提供了翻译质量评估功能，可计算多种评估指标。

Multilingual - AI驱动的多语言同步翻译工具支持多种文件格式

AI工具AI翻译在线字符统计多语言翻译文件解析语音转换

Multilingual.top是一款基于AI技术的免费多语言同步翻译工具，支持将文本同时翻译成多种语言。平台利用人工智能技术提供精确自然的翻译结果，用户可直接输入文本或上传JSON、PDF、DOC、DOCX等格式文件。除翻译功能外，还集成了在线字符计数和文本转语音等实用工具。该工具适用于营销团队、语言学习者和开发人员等多种场景，为用户提供高效的多语言解决方案。

相关项目

项目侧边栏1

项目侧边栏2

推荐项目

Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手，通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能，支持100+编程语言，与主流编辑器无缝集成，显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台，能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐，Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案，通过智能技术简化视频制作流程。无论是企业宣传还是个人分享，有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持，能够阅读和理解用户上传的文件内容，解析网页信息，并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题，Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术，为商家提供一键生成商品图和营销文案的服务，显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台，让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型，免费访问各种图像生成与AI训练工具，从Stable Diffusion等基础模型开始，轻松实现创新图像生成。体验前沿的AI技术，推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器，它将改变您观看视频的方式！SubCat结合了先进的人工智能技术，为您提供即时视频字幕翻译，无论是本地视频还是网络流媒体，让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台，利用前沿AI技术，为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图，再到文案生成，美间让创意设计更简单、更高效。

Project Cover

稿定AI

稿定设计是一个多功能的在线设计和创意平台，提供广泛的设计工具和资源，以满足不同用户的需求。从专业的图形设计师到普通用户，无论是进行图片处理、智能抠图、H5页面制作还是视频剪辑，稿定设计都能提供简单、高效的解决方案。该平台以其用户友好的界面和强大的功能集合，帮助用户轻松实现创意设计。

使用协议隐私政策广告服务

投诉举报邮箱: service@vectorlightyear.com

@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号