PDF 提取文字 / OCR:扫描件也能出 TXT

能选中复制的 PDF 有文字层,可直接导出;纯扫描件需要 OCR。图图我呀在浏览器本地识别:文件不上传,首次使用会从 CDN 下载识别库到你的浏览器。

最近更新:2026年8月8日

需要马上处理?使用 PDF 提取文字 ,浏览器本地完成,不上传服务器。

打开提取文字

智能 / 仅文字层 / 全程 OCR

智能模式先读文字层,空白页再 OCR,速度与覆盖较均衡。确定是扫描件可选全程 OCR;确定可选中文字则仅文字层更快。

识别率受清晰度、倾斜、复杂版式影响。重要合同请人工校对后再用。

导出与隐私

可合并为一个 TXT,或按页打包 ZIP。只要版式页面请用提取页面;只要配图用提取图片。

识别库下载不等于上传你的 PDF。处理仍在本地完成。

操作步骤

  1. 上传 PDF
  2. 选择智能 / 仅文字层 / 全程 OCR,以及合并或按页导出
  3. 下载 TXT 或 ZIP,并预览校对

常见问题

会上传我的 PDF 吗?

不会。文件在本地处理;首次 OCR 仅下载识别库。

扫描件能识别中文吗?

可以,清晰度越高效果越好。

和提取页面有何区别?

提取页面得到 PDF;本工具得到纯文本。