跳到主要内容
AZ Tools

PDF 页面提取

用 `pdf-lib` 加载 PDF,通过带逗号与短横线的范围表达式选择任意页面子集,并按你输入的顺序重新输出一个仅包含这些页面的新 PDF。页面与源在视觉上完全一致;丢弃的是其它一切。适合分享合同中的一节而不泄露其余,或者把一份长报告裁剪到附录。

拖入一个 PDF 以选择页面。

全部在你的浏览器中处理 — 文件不会离开你的设备。

使用方法

  1. 拖入或选择一个 PDF。
  2. 输入页面范围,如 `1-3, 5, 7-10`。空格可选。
  3. 点 Extract 然后 Download。新文件的页数会显示以便核对。

常见问题

源页面是被重新渲染还是被复制?
复制 — `pdf-lib` 的 `copyPages` 克隆页面对象,因此文字、矢量绘图、图像和嵌入字体都按字节一致地搬过来。视觉结果与原版完全相同。
页面顺序如何?
输出按你在范围中写的顺序排列。`5, 1-3` 表示先是第 5 页,然后 1、2、3。在 `7-10` 这种范围内页面保持自然顺序。
可以从加密 PDF 提取页面吗?
不行——会被拒绝并给出说明。`pdf-lib` 能打开加密文档却无法解密,页面流仍是加密状态,导出的文件任何阅读器都打不开,而且毫无提示。请先在 PDF 阅读器里去掉保护,再来提取。
提取页面之后,被排除页面上的内容就没有了吗?
那些页面本身没有了,但 PDF 里装的不只是页面。文档元数据,以及保留下来的页面仍在引用的东西,都可能随副本一起带走;而在你保留的页面上被图片盖住的文字,在输出里依然是文字。如果提取的目的正是为了不泄露某些信息,请像收件人那样检查结果:把它的文本抽出来,看看出现了什么。
为什么提取出来的文件几乎和原件一样大?
因为字体、图片和色彩配置文件在整份文档中只保存一份,由用到它们的页面来引用。从一百页里取出两页,仍可能把整套内嵌字体或一张很大的共享图片一起带走。真正让体积变小的,是之后再过一遍压缩工具——那一步才能丢掉剩余页面都不再引用的那些对象。

相关主题指南

相关工具