Project Icon

gImageReader

基于tesseract-ocr的开源图像文字识别工具 支持多格式处理

gImageReader是一个基于tesseract-ocr的开源图像文字识别工具。它提供简洁的Gtk/Qt前端界面,支持从多种来源导入PDF和图像,包括磁盘、扫描设备、剪贴板和屏幕截图。该工具可批量处理文件,支持手动或自动定义识别区域,输出格式包括纯文本和hOCR。gImageReader还具备文本后处理、拼写检查和生成PDF等功能,支持多语言识别。作为一款功能全面的OCR软件,gImageReader为用户提供了便捷的文字识别解决方案。

textract - 多格式文档文本提取工具
GithubPython库textract开源项目文本提取文档处理
textract是一个开源文本提取工具,支持从多种格式文档(如PDF、Word、Excel等)中提取文本。该项目最初由Dean Malmgren创建,现由Jazzband社区维护。textract提供简单接口,具备全面的文档支持,旨在简化文本提取流程。它适用于需要从不同类型文档中批量提取文本的场景,为用户提供高效的文本提取解决方案。
magi - 漫画内容自动转录与角色识别系统
AI模型GithubMagi开源项目文本识别漫画计算机视觉
Magi是一个开源项目,致力于自动生成漫画转录和角色识别。该系统可以定位文本框、识别说话人物,并生成漫画对话转录。Magiv2版本支持整章漫画处理和角色名称识别。Magi为研究人员和漫画爱好者提供了获取漫画文本内容的工具,提高了漫画的可访问性和分析便利性。
OpenScan - 注重隐私的开源文档扫描应用
GithubPDF转换开源应用开源项目文档扫描移动办公隐私保护
OpenScan是一款注重隐私的开源文档扫描应用,支持将纸质文档、笔记、名片和收据转换为PDF或JPG文件。应用无广告、不收集数据,提供简单而强大的裁剪功能。无论是提高办公效率还是学习生产力,OpenScan都能满足快速扫描、保存和分享文档的需求。适用于办公人员扫描合同文件、学生记录讲义笔记、商务人士整理名片信息等多种场景。
texify - 高效OCR模型,图像数学公式到Markdown和LaTeX的转换工具
GithubLaTeXOCRTexify图像转换开源项目机器学习
Texify是一个开源OCR模型,可将含数学公式的图像或PDF转换为Markdown和LaTeX格式。支持块级和内联公式,兼容CPU、GPU和MPS。基于多样化数据集训练,相较其他开源工具准确度更高。提供GUI、命令行和Python API,适用于多种场景。
Bob - 在Mac平台上的全功能翻译和OCR工具
BobGithubOCRmacOS开源项目截图识别翻译
Bob为macOS用户提供全方位的翻译与OCR解决方案,支持文本、截图、输入及OCR翻译等多样化功能。整合了主流翻译引擎,如Google翻译和腾讯翻译君,确保准确快速地完成翻译任务。其高效的OCR技术,适用于多种应用场景,简化了文本识别过程。Bob的简洁界面和强大功能,使其成为提升Mac用户工作效率的优选工具。
SmartImage - Windows平台反向图像搜索工具 支持多引擎一键查找
GithubSmartImageWindows工具反向图像搜索图像搜索开源项目
SmartImage是一款Windows平台的反向图像搜索工具。它利用多个图像搜索引擎查找最佳匹配结果,并在浏览器中直接显示。该工具集成了上下文菜单功能,支持右键快速搜索。SmartImage分为图形界面版和跨平台命令行版,兼容多种搜索引擎。工具操作简便,支持多种图像输入方式,适用于快速追溯图像来源。
audiveris - Audiveris 将乐谱图像转换为数字符号的开源软件
AudiverisGithubOMR光学音乐识别开源软件开源项目音乐转录
Audiveris是一款开源的光学音乐识别软件,可将乐谱图像转换为数字符号。它集成了OMR引擎和编辑器,能有效识别各种质量的乐谱,支持大型乐谱处理。Audiveris提供用户友好的界面,方便检测和纠正错误。支持Windows、Linux和MacOS平台,核心数据公开,可导出MusicXML格式。Audiveris适用于处理IMSLP等网站上的真实乐谱,支持处理多达数百页的大型乐谱。它为音乐学者、编曲家和音乐爱好者提供了便捷的乐谱数字化工具,为音乐数字化提供了强大的工具支持。
STranslate - 多功能翻译和OCR工具,基于WPF开发
GithubOCRSTranslateWPF开源项目翻译工具
STranslate是一款多功能的翻译和OCR工具,基于WPF开发,满足各种翻译和文字识别需求。用户可以下载最新版本并参阅使用文档获取帮助。项目提供讨论社区,向所有贡献者和灵感来源致谢,并欢迎通过微信或支付宝进行捐赠支持。
papermage - 统一工具包助力处理表示和操作视觉文档
GithubPDF解析papermage实体识别开源项目数据结构文档处理
papermage是一款专门用于处理PDF文档的开源工具包。它能够创建Document对象、解析文档结构、提取文本和元数据。该工具支持多层次文档分割,包括页面、行和句子等,并可在不同层次间自由导航。papermage允许保存和加载Document对象,还支持通过自定义预测器进行功能扩展。这个统一平台为处理、表示和操作视觉丰富的文档提供了便利。
Imaginer - AI驱动的图像生成工具,提供便捷安装和使用指南
AIGithubImaginer安装方法开源项目翻译贡献
Imaginer是一款利用AI技术进行图像生成的工具,提供多种安装方式,包括Flatpak、最新CI构建和源代码编译。网站提供详细教程和贡献指南,并支持多语言翻译,是图像生成爱好者的优质选择。
项目侧边栏1项目侧边栏2
推荐项目
Project Cover

豆包MarsCode

豆包 MarsCode 是一款革命性的编程助手,通过AI技术提供代码补全、单测生成、代码解释和智能问答等功能,支持100+编程语言,与主流编辑器无缝集成,显著提升开发效率和代码质量。

Project Cover

AI写歌

Suno AI是一个革命性的AI音乐创作平台,能在短短30秒内帮助用户创作出一首完整的歌曲。无论是寻找创作灵感还是需要快速制作音乐,Suno AI都是音乐爱好者和专业人士的理想选择。

Project Cover

有言AI

有言平台提供一站式AIGC视频创作解决方案,通过智能技术简化视频制作流程。无论是企业宣传还是个人分享,有言都能帮助用户快速、轻松地制作出专业级别的视频内容。

Project Cover

Kimi

Kimi AI助手提供多语言对话支持,能够阅读和理解用户上传的文件内容,解析网页信息,并结合搜索结果为用户提供详尽的答案。无论是日常咨询还是专业问题,Kimi都能以友好、专业的方式提供帮助。

Project Cover

阿里绘蛙

绘蛙是阿里巴巴集团推出的革命性AI电商营销平台。利用尖端人工智能技术,为商家提供一键生成商品图和营销文案的服务,显著提升内容创作效率和营销效果。适用于淘宝、天猫等电商平台,让商品第一时间被种草。

Project Cover

吐司

探索Tensor.Art平台的独特AI模型,免费访问各种图像生成与AI训练工具,从Stable Diffusion等基础模型开始,轻松实现创新图像生成。体验前沿的AI技术,推动个人和企业的创新发展。

Project Cover

SubCat字幕猫

SubCat字幕猫APP是一款创新的视频播放器,它将改变您观看视频的方式!SubCat结合了先进的人工智能技术,为您提供即时视频字幕翻译,无论是本地视频还是网络流媒体,让您轻松享受各种语言的内容。

Project Cover

美间AI

美间AI创意设计平台,利用前沿AI技术,为设计师和营销人员提供一站式设计解决方案。从智能海报到3D效果图,再到文案生成,美间让创意设计更简单、更高效。

Project Cover

AIWritePaper论文写作

AIWritePaper论文写作是一站式AI论文写作辅助工具,简化了选题、文献检索至论文撰写的整个过程。通过简单设定,平台可快速生成高质量论文大纲和全文,配合图表、参考文献等一应俱全,同时提供开题报告和答辩PPT等增值服务,保障数据安全,有效提升写作效率和论文质量。

投诉举报邮箱: service@vectorlightyear.com
@2024 懂AI·鲁ICP备2024100362号-6·鲁公网安备37021002001498号