PDF 提取文字
提取 PDF 文字层并导出 TXT;扫描件可选用本地 OCR。支持合并或按页打包,全程浏览器处理。
拖拽 PDF 到此处,或点击上传
支持文字层提取与本地 OCR(扫描件),全程不上传
源文件
尚未选择文件
上传一份需要提取文字的 PDF
文本预览
请先上传 PDF
提取后可在此预览文字并下载 TXT
提取方式
提取模式
单文件不超过 80.00 MB。OCR 识别在本地完成;识别库来自 CDN,准确率受扫描质量影响。
关于「PDF 提取文字」
需要从 PDF 复制或导出正文时,可用本工具在浏览器内提取:默认智能模式先读文字层,空白页再本地 OCR;也可全程 OCR 或仅文字层。支持合并为一个 TXT 或按页打包 ZIP,识别库首次需下载,文件本身不上传。
本地处理不上传服务器免费使用
适用场景
- 从报告、合同中导出正文便于编辑
- 扫描件 PDF 本地 OCR 识别中文
- 课件 PDF 提取讲义文字归档
- 隐私文档不想上传第三方网站时本地提取
使用步骤
- 上传需要提取文字的 PDF
- 选择智能 / 仅文字层 / 全程 OCR,以及合并或按页导出
- 提取完成后下载 TXT 或 ZIP,并可预览文本
常见问题
提取文字会上传 PDF 吗?
不会。文件处理在本地完成;首次 OCR 会从 CDN 下载识别库到浏览器。
扫描件 PDF 能提取吗?
可以。选择「智能」或「全程 OCR」即可本地识别;清晰度与排版会影响准确率。
和「PDF 提取页面」有什么区别?
提取页面导出的是 PDF 页;本工具导出的是纯文本 TXT。
支持加密 PDF 吗?
暂不支持已加密或带密码的 PDF,请先解除保护后再提取。