压缩 PDF
用两种方式缩小 PDF 文件体积:一种是保留全部内容的无损清理,另一种是通过栅格化让扫描文档显著变小,但代价是文字不再可选中。
- 文件永不离开你的设备
- 免费,无需注册
- 无水印
- 加载后可离线使用
如何压缩 PDF
- 1
添加你的 PDF
把文档拖到页面上。
- 2
选择一种模式
无损模式保留全部内容。栅格化模式压缩力度大,但会把文字变成图片。
- 3
下载
如果压缩反而会让文件变大,工具会直接返回原文件。
为什么"压缩 PDF"其实指的是两件不相关的事
一份最初来自 Word 文档或设计软件导出的 PDF,本质上是文字、矢量图形和嵌入字体的容器,缩小它意味着精简这套结构——去除重复的字体子集,重新压缩已经存在的嵌入位图,清除未使用的元数据和无引用对象。这些操作都不会触及文字本身,文字依然像之前一样完全可选中、可搜索。这里能节省的体积通常比较有限,往往在百分之几到二十左右,因为一份结构良好的文档本来就没有太多可以精简的冗余。
相比之下,一份最初来自扫描仪的 PDF,实际上是一连串包裹在 PDF 外壳里的整页照片,根本没有真正的文字——看起来像文字的部分,其实是排列成文字模样的像素。缩小这类文件意味着以更低的分辨率或质量重新编码每一页图像,这与压缩一张 JPEG 是完全相同的取舍。这里能节省的体积非常可观,通常是 70%–90%,正因为一份按打印分辨率扫描的整页图像,携带的像素数据远超屏幕实际显示所需。
把这两种情况当作同一个"压缩级别"来处理,会掩盖真正重要的那个决定:一条路径可以安全地应用于任何文档,另一条路径会把真实文字永久转换为图片,且无法撤销。把它们保留为两种明确的模式,意味着这个选择是清晰可见的,而不是被埋藏在一个滑块里。
分辨这两种 PDF
最可靠的判断方法是文档中的文字能否被选中和复制。打开文件,尝试点击并拖动划过一行文字,如果出现文字光标和选中高亮,说明文档有真实文字,此时应该使用无损模式——对它做栅格化会让文件变大而不是变小,因为把清晰的矢量文字重新编码成像素图,无论从哪个方向看都是一笔亏本的交易。如果点击没有任何选中效果,整个页面表现得像一张单一图片,那就是扫描件,栅格化模式才是合适的选择。
一份混合文档——比如一份合同,大部分是数字页面,末尾附加了一页扫描的签名页——整体测试下来会显示有真实文字,无损模式是它的正确选择;文档内嵌入的那张扫描图像,依然能从无损模式对嵌入图片专门做的重新压缩中受益,同时不会触碰文档其余部分的结构。
服务器端压缩工具能做到、而这里做不到的事
你有时会看到这个工具和某个服务器端 PDF 压缩工具之间的体积差异,这不是一个需要感到难为情的局限——它是完全在浏览器内处理、而不是把文件发送到配备完整 PDF 引擎和专用图像编解码器的服务器所带来的直接后果。一个服务器端工具可以把字体精简到只保留实际用到的字形,用专门调校的编码器重新编码嵌入图片,并从头重建整个对象结构。在没有后端的浏览器标签页里复现这一切,是一个本质上不同的工程问题,这个工具坦诚地只做了其中更小、更安全的一部分,而不是虚假宣称达到了同等水平。
作为交换,你得到的很直接:文档永远不会离开你的设备,所以对一份合同或病历做压缩,永远不会变成一个数据处理层面的问题,也没有页数限制、月度配额,或是把"免费压缩的部分够小"和"其余部分要付费"分隔开的付费墙。
常见问题
为什么是两种模式,而不是一个滑块?
因为这两种模式做的是完全不同的事,而且只有一种效果是可逆的。无损模式重写文件结构——通常只节省百分之几,如果文档携带大量元数据,节省会更多一些。栅格化模式把每一页重新渲染成图片,能把扫描文档压缩 80%,但会永久破坏文字的可选中性。把它们混成一个"压缩级别"会掩盖真正重要的那个选择。
我该用哪种模式?
如果你的 PDF 是扫描件——页面的照片,没有可选中的文字——栅格化模式正是你需要的,而且损失极小,因为文字本来就已经是图片了。如果你的 PDF 有真实文字,请使用无损模式:对它做栅格化通常会让文件*变大*,而且还会失去可搜索性。
为什么我节省的体积比其他工具宣称的要少?
专门的服务器端压缩工具会用调校过的编解码器重新编码嵌入的图片、精简字体子集、重建整个对象结构——这些工作都需要一个完整的 PDF 处理引擎。这个工具坦诚地做得更少。作为交换,你的文档永远不会离开你的设备,也没有页数限制或付费墙。
如果压缩反而让文件变大了会怎样?
你会拿回原始文件,并附带一条说明。一个叫"压缩"的工具却悄悄给你一个更大的文件,那比没用还糟糕。
它能处理加密的 PDF 吗?
不能。加密文件会被直接拒绝,而不是被悄悄剥除保护。