PDF OCR

PDF OCR:处理PDF并生成ZIP。下载前请查看任务选项、限制和隐私边界。

在服务端处理· 文件: 1 · 50 MB
文件

也可以从设备选择文件。只有按下处理按钮后才会开始。

服务端
01 选择文件02 检查03 处理04 下载

将文件拖到这里

也可以从设备选择文件。只有按下处理按钮后才会开始。

参数
已保存预设0
选择文件

使用步骤

PDF OCR 会在下载前复查输出。OCR 是近似结果,在服务端用 Tesseract 运行。扫描件更适合 OCR,而不是直接抽文本。

  1. 01添加受支持的 PDF。处理前会核对真实文件类型,而不是只看扩展名。
  2. 02仅在需要时使用:OCR 语言。超出限制的文件会被拒绝。
  3. 03检查结果的大小、格式和页数/尺寸后再下载。压缩类任务如果没有变小会保留原文件。

限制与支持

最多 1 个文件,每个输入不超过 50 MB,最多 300 页。输出会在下载前检查。

隐私说明

此任务使用服务端引擎,上传前必须明确同意,结果默认 15 分钟后删除。

输出

PDF OCR 会在下载前复查输出。OCR 是近似结果,在服务端用 Tesseract 运行。扫描件更适合 OCR,而不是直接抽文本。

参数

PDF OCR 的控件:OCR 语言。限制:最多 1 个文件,每个 50 MB,最多 300 页。

常见问题

支持哪些文件?

PDF OCR 接受 PDF,生成 ZIP。处理前会检查实际文件类型。 OCR 是近似结果,在服务端用 Tesseract 运行。扫描件更适合 OCR,而不是直接抽文本。

这个任务会上传我的文件吗?

此任务在服务端处理,工作台会在发送文件前明确请求上传同意。 此任务使用服务端引擎,上传前必须明确同意,结果默认 15 分钟后删除。

有哪些可用选项?

可用控制项包括:OCR 语言。 限制:最多 1 个文件,每个 50 MB,最多 300 页。