数据去向 本地存储 需上传 详情
本地存储:本页的处理记录与结果文件(存 IndexedDB) —— 只存在本浏览器,清缓存或换电脑会丢,请定期备份。
需上传:你选择的文件会上传到服务器处理,暂存 30 分钟后自动删除
从 PDF 里提取内容:文本导出 Word(.docx,可直接编辑)、表格导出 .xlsx(每表一个 Sheet)、内嵌图片按原格式导出。
勾选多项或图片多张时打包 ZIP 下载。扫描版 PDF 没有文字层,会自动用本地 OCR 识别成文字(约 2~4 秒一页,不超过 60 页;
再长请先用「PDF 拆分」分小份)。
💡 本工具提取的是纯内容(文字/表格/图片各自分离)。想把 PDF 连排版一起原样变成 Word
(字号、段落、表格位置都保留、可直接编辑),请用 PDF 转 Word。
🧲
点击选择(可多选),或把 PDF / 图片拖到这里
可多选批量 · 单文件 ≤ 100MB · 图片支持 JPG / PNG / WebP / HEIC
PDF 内容提取怎么用
- 选择或拖入 PDF 文件,可多选批量
- 勾选要提取的内容:文本、表格或图片
- 点击「开始提取」,多项结果打包 ZIP 下载
常见问题
三种内容分别导出成什么?
文本导出为可编辑的 .docx,表格导出 .xlsx 且每个表格一个工作表,内嵌图片按原始格式逐个导出;勾选多项时打包 ZIP 下载。
扫描版 PDF 能提取吗?
可以,文本和表格会自动用本地 OCR 识别,约 2~4 秒一页、建议不超过 60 页,更长的文件请先用「PDF 拆分」分小份;提取图片不需要 OCR。
和「PDF 转 Word」有什么区别?
本工具导出的是分离的纯内容,文字、表格、图片各自成文件;想连排版一起原样变成 Word,请用「PDF 转 Word」。
我的文件安全吗?
文件上传到服务器处理,暂存 30 分钟后自动删除。
处理记录