Pix2Text
Pix2Text是一款免费开源的Python工具,主要功能与Mathpix类似,能够将复杂布局的图像、表格、文本和数学公式转换为Markdown格式。它支持超过80种语言的文本识别,包括简体中文、繁体中文、英语和越南语。最新的V1.1.1版本引入了新的数学公式检测模型,大幅提升了识别准确性。用户也可以通过在线服务和演示来体验其强大功能。
pix2text-mfr
Pix2Text-MFR模型基于TrOCR架构,支持将数学公式图片转化为LaTeX文本,适用于印刷体和手写公式的高效识别。最新版Pix2Text V1.0提升了模型精度,但该模型的使用面仅限于数学公式图片。