提取 PDF 图片
在浏览器中完成,无需上传
按存储原样 · JPEG 未重新编码
规格
6 项| 项目 | 数值 | 备注 |
|---|---|---|
| 输入 | 按文件内容判断,而不是文件名 | |
| 输出 | 里面的每一张图片 | JPEG 仍是 JPEG;其余为 PNG,Group 4 传真扫描和 CMYK 为 TIFF |
| JPEG | 复制取出 | 文件就是 PDF 里存着的压缩图片 |
| 像素 | 按存储原样 | 保持图片自己的分辨率——不重画 |
| 文件大小 | 这台设备能处理多少都行 | 文件在这个标签页里读取,不会发送到任何地方 |
| 处理位置 | 这个浏览器 | 不发送到服务器 |
会发生什么
4会发生什么,为什么
拖入 PDF,页面画出的每一张图片都作为单独的文件返回,按页面顺序排列,旁边各有下载,也可以打包成一个 ZIP。没有要设置的东西:文件一打开就开始提取。
扫描仪生成的 PDF 通常是每页一张 JPEG,外面包着一页。PDF 把那张 JPEG 完全按扫描仪写入的样子保存——每个 PDF 阅读器都有 JPEG 解码器——所以取出它就是复制:你下载的文件逐字节就是 PDF 里的那张压缩图片,保持扫描时的分辨率。换成画出页面(PDF 转 JPG)会对扫描件重新采样并再压缩一次;这里两者都不会发生,标签也这样说明。如果 PDF 给图片指定了颜色配置文件,这个配置文件会写进 JPEG 的文件头,让颜色保持页面上的样子。
其他图片以它们的压缩方式允许的最忠实的文件取出。以 PNG 方式压缩的图片会成为包着同样压缩数据的 PNG 文件。以传真压缩(Group 4)存储的黑白扫描会成为原样装着传真数据的 TIFF 文件;TIFF 是保存传真扫描的格式。以 JBIG2(许多扫描仪用于文字页、却很少有图片查看器能打开的压缩)或其他传真方式存储的黑白扫描会被解码,写成 1 位 PNG,每个像素都是 PDF 里的值。其余的解开后无损写出——存为保持位深、调色板和透明度的 PNG,CMYK 则存为 TIFF,因为 PNG 装不下 CMYK。每一行都有自己的标签。
专色或 Lab 颜色的图片不会取出,因为常见的图片文件装不下这些颜色;标签下方的说明会计数。这些页面用 PDF 转 PNG 画出。直接写在页面绘制指令里、没有作为独立图片存储的很小的图片不会列出。什么都不上传:文件在这个标签页里读取,图片也在这里写出。
常见问题
5是原始画质吗
对 JPEG 来说是的——它是原始文件,而不是对外观的再拍摄。压缩数据逐字节取出,所以像素、尺寸和压缩都与在 PDF 里时完全相同。其他图片要么以同样的方式复制,要么解开后无损写出;每一行的标签会说明是哪一种。
为什么图片比页面小
因为它就是以那个尺寸存储的。PDF 可以把一张 1000 像素的照片拉满整个 A4 页面;里面的图片仍然是 1000 像素宽。这个页面给你的是存在的像素,而不是编造更多。要按固定分辨率得到页面图片,用 PDF 转 JPG 来画。
为什么图片出来是 TIFF
它的存储方式是 JPEG 和 PNG 不改变就装不下的:用 Group 4 传真压缩的黑白扫描,或者为印刷制作的 CMYK 图片。TIFF 两者都能原样装下。Mac 的预览和 Photoshop 能打开它。
为什么少了一张图片
要么它的格式是这个页面不取出的——专色、Lab——标签下方的说明里有计数;要么它根本不是图片:文字、线条和形状是绘制指令,不是图片。PDF 转 PNG 会把整页连同它们一起画出来。
PDF 会上传吗
不会。浏览器从你的磁盘读取文件,新文件也在这个页面上写出。本网站没有上传接口,文件根本无处可去。也不会留下任何关于文档的记录——这个页面甚至不知道你的文件有几页。