扫描 PDF 识别

先把扫描版 PDF 逐页渲染成图像再识别文字,输出按页分段的文本,适合把纸质合同、书籍扫描件转成电子版。

支持单个 PDF,最多 100 页

工具操作区

选择扫描版 PDF(文字无法选中的那种)

扫描件识别较慢,页数多时建议分批或限定范围。

首次识别会在本地加载识别引擎与语言包(约 6MB,已自托管不走外网),之后浏览器会缓存,后续识别很快。

使用说明

  1. 1

    上传 PDF

    选择扫描版文件。

  2. 2

    选择清晰度

    渲染倍数越高识别越准,但也会更慢。

  3. 3

    逐页识别

    系统会按页排队处理并显示进度。

  4. 4

    导出文本

    结果按页分段,可直接复制或下载。

输出说明:输出 TXT 文本,按页标记

常见问题

相关工具推荐