← 返回 PDF 工具

PDF 内容提取

文本 · 表格 · 图片,一键导出
数据去向 本地存储 需上传 详情

本地存储:本页的处理记录与结果文件(存 IndexedDB) —— 只存在本浏览器,清缓存或换电脑会丢,请定期备份。

需上传:你选择的文件会上传到服务器处理,暂存 30 分钟后自动删除

从 PDF 里提取内容:文本导出 Word(.docx,可直接编辑)、表格导出 .xlsx(每表一个 Sheet)、内嵌图片按原格式导出。 勾选多项或图片多张时打包 ZIP 下载。扫描版 PDF 没有文字层,会自动用本地 OCR 识别成文字(约 2~4 秒一页,不超过 60 页; 再长请先用「PDF 拆分」分小份)。
💡 本工具提取的是纯内容(文字/表格/图片各自分离)。想把 PDF 连排版一起原样变成 Word (字号、段落、表格位置都保留、可直接编辑),请用 PDF 转 Word
🧲
点击选择(可多选),或把 PDF / 图片拖到这里
可多选批量 · 单文件 ≤ 100MB · 图片支持 JPG / PNG / WebP / HEIC

PDF 内容提取怎么用

  1. 选择或拖入 PDF 文件,可多选批量
  2. 勾选要提取的内容:文本、表格或图片
  3. 点击「开始提取」,多项结果打包 ZIP 下载

常见问题

三种内容分别导出成什么?

文本导出为可编辑的 .docx,表格导出 .xlsx 且每个表格一个工作表,内嵌图片按原始格式逐个导出;勾选多项时打包 ZIP 下载。

扫描版 PDF 能提取吗?

可以,文本和表格会自动用本地 OCR 识别,约 2~4 秒一页、建议不超过 60 页,更长的文件请先用「PDF 拆分」分小份;提取图片不需要 OCR。

和「PDF 转 Word」有什么区别?

本工具导出的是分离的纯内容,文字、表格、图片各自成文件;想连排版一起原样变成 Word,请用「PDF 转 Word」。

我的文件安全吗?

文件上传到服务器处理,暂存 30 分钟后自动删除。

处理记录
🏠