提取 PDF 内嵌的图片
报告里的照片,画质通常比它所在的那一页更清晰。这个工具取出的是内嵌的原始图片,而不是把那一页截个图。
- 完全在你的浏览器里运行
- 断网也能用
- 不上传
- 不用注册
- 没有水印
正在加载工具……
工作原理
- 把 PDF 拖进来。
- 每一张内嵌图片都会按真实像素尺寸显示出来。
- 下载你需要的那些,或者把全部打包成 ZIP。
为什么什么都不用上传
这个页面上的每一步操作,都由运行在你浏览器标签页里的代码完成,用的就是渲染网页的那套引擎。文件从磁盘读进标签页的内存,在那里被处理,再作为下载写回去。它不会被送到任何地方 —— 不会送给我们,也不会送给第三方。
自己动手验证
- 打开浏览器的开发者工具(F12),选择“网络”(Network)面板。
- 载入你的文件,运行这个工具。
- 你能看到的请求只有这些:工具自己的代码 —— 少数几个重型工具还会从公共 CDN 取它们的开源引擎 —— 外加一条发往 loreatec.jp 的小小访问记录(页面地址和标题,仅此而已)。没有一条带着你的文件。
常见问题
这个和把 PDF 转换成图片有什么不一样?
页面转换是按你选的分辨率给整个页面拍一张照 —— 文字、页边距全都在内。这个工具取出的是文件内部存储的图片本身,分辨率就是它们当初保存时的那个分辨率。要找回一张照片,这个才是你要用的工具。
为什么有些图片比它在页面上看起来的样子大得多?
因为作者经常会把一张高分辨率照片缩小了放进去。文件里保留的是原始像素,页面上显示的只是缩小后的样子。你拿到的是原始存储的像素,这正是这个工具的意义所在。
为什么我的扫描版 PDF 每页只提取出一张图片?
因为扫描件本来就是这样:每一页就是一张照片,上面往往还叠着一层用 OCR(文字识别)生成的、看不见的文字层。提取出来,你拿回的就是那张原始的扫描图片。
被跳过的那些小图片是什么?
是 Logo、项目符号、分隔线和图标 —— 一份商务 PDF 里到处都是这些东西。默认会跳过 32 像素以下的图片,好让真正的内容显得突出;勾选相应选项就能把它们也包括进来。