Nirmion
帮助 找一个工具

PDF 文档工作板

做扫描 PDF 可以用英语搜索的页面 OCR是

每个页面,以本地识别英语文本 Tesseract 重建支持的图像 PDF 可搜索的无形文本层。

1 PDF 最多50页10 MB 合并限制可搜索 OCR PDF
放下区域准备好10 MB 合并

放下一个 PDF 这里

选择一个开锁 PDF是 源头保持不变,结果单独下载。

文件仅在运行工具时发送;没有服务器侧工作历史创建。

步骤2 / 设置和运行

设置 OCR PDF

确认英语作为识别语言,然后保持页面开放,而每个页面都被视为识别和识别。

查看此处理器

當地服務目前擁有英國認知模式。
请求处理當地的 API 将此请求处理在内存中,以 Cache-Control: no-store 返回下载,并未创建服务器侧工作历史。

产品合同

理解 OCR PDF 处理之前

每个页面,以本地识别英语文本 Tesseract 重建支持的图像 PDF 可搜索的无形文本层。

01

你所提供的

一个被锁定 PDF 到上 10 MB 五十页。 安装的识别模型在此版本中支持英语。

02

你所得到的

一个 _nirmion_tools_ocr_searchable.pdf 页面图像和可搜索的图像 OCR 文本层。

03

什么要审查

识别可能在手写、滑板、低对比、复杂表和混合语言上是错误的。 OCR 输出不是经过认证的转换。

工作流

从源头到检查下载

工作空间在启动操作之前检查文件和处理器的准备。

1。 选择

一个被锁定 PDF 到上 10 MB 五十页。 安装的识别模型在此版本中支持英语。

二。 设置

确认英语作为识别语言,然后保持页面开放,而每个页面都被视为识别和识别。

3、 检查一下

搜索并从结果中复制样本文本,然后比较名称、数量、日期和法定编辑与可见的页面图像。

常用用

什么时候 OCR PDF 是有用的

做扫描 PDF 可以用英语搜索的页面 OCR是

01

在审查之前,让扫描协议可搜索。

02

为文本或表提取的图像单一发票做好准备。

03

创建可复制的文本从拍摄的英语页面。

重要边界

OCR 总是需要人类检查。

不要依靠认可的文本,以便在未检查可见扫描的情况下获得法律、医疗、财务或身份数据。

实用帮助

提问之前,你就开始了

是的 OCR 翻译文档?

没有。 它识别英语字符,并保留可见的页面图像。

为什么产量更大?

每个页面都将转化为图像支持的搜索 PDF是

能读手写吗?

手写的准确性不被承诺;使用清晰印刷的文本获得最佳结果。

文件工作流

使用 OCR PDF 在线与一个有限的地方 API是

每个页面,以本地识别英语文本 Tesseract 重建支持的图像 PDF 可搜索的无形文本层。 一个被锁定 PDF 到上 10 MB 五十页。 安装的识别模型在此版本中支持英语。

一个 _nirmion_tools_ocr_searchable.pdf 页面图像和可搜索的图像 OCR 文本层。 识别可能在手写、滑板、低对比、复杂表和混合语言上是错误的。 OCR 输出不是经过认证的转换。 下载后,表格重新设置和三个选项卡内存结果仍然可重新下载。