英文图片转文字

仅在当前浏览器处理

文件上限:32 MB

此工具不会上传你的输入。

首次使用时,浏览器可能会下载一个本地库。

英语优先的 Tesseract(eng)。不要用来识身份证或中文证件。首次会在本标签页下载模型。

拖入文件

将文件拖到此处,或点击选择。

示例:拖入印刷文字照片,然后处理。首次会下载识别模型。

报错截图、英文说明书要拷出来。中文证件和手写请不要用这一页,识别率会对着你撒谎。中文头词被证件和身份证占满,产品只有 eng。

英文报错截图要贴进工单——英文为主的 OCR。中文头词被证件和身份证占满,产品只有 eng,标题必须写清。PaddleOCR、证件套件是另一类产品,我们不抢。

有文字层的 PDF 走提取文本。只要图片走相册工具。两版识别结果对比走 Diff

英文界面,不是证件

  • eng 为主。竖排中文、印章、身份证不追
  • 能复制的 PDF 先提取文本。大约 32 MB
  • 不是证件。不是中文主力。
  • 首次下载模型是预期;图仍留在标签页。公司策略若拦模型文件,识别会起不来。

怎么用

  1. 放入清晰的英文印刷体或界面截图。先转正、裁掉无关边。
  2. 识别。校对专有名词、数字、报错码。
  3. 中文合同、证件离开本页。

使用前先看清的限制

不是证件。不是中文主力。大约 32 MB。手写和章会差。识别结果要人工校对。

常见问题

能认身份证吗?

不能,也不该。本页是 eng。证件请走正规渠道。不要把证件照丢给任何识别站。

和 PDF 提取文字?

提取页要数字 PDF 的文字层。扫描件没有层,英文扫描可以试试本页。中文合同离开。

手写、印章?

印刷体稳一些。手写和章会差。斜拍、反光、分辨率低也会瞎。

模型下载到哪?

浏览器缓存。不是把你的图传到识别站。首次下载是预期行为。

中文界面截图呢?

不是中文主力。英文报错、英文说明书才是本页的活。中文请用别的方案,不要指望 eng 瞎认。

相关工具