ImgIng 图映ImgIng 图映 · DataDance 旗下产品中文EN日本語한국어DEESPTFR打开 PDF 压缩
ImgIng 图映 / PDF 压缩
SELF-BUILT PDF ENGINE

PDF 压缩:双向有效 DPI 与内容感知结构优化

图映不把 PDF 转成 HTML 或整页图片,而是在本机直接优化原文档结构:逐张处理内嵌图,并根据实际绘制内容回收未使用资源;页面尺寸、文字、链接与矢量图形保持原样。

PDF 不上传双向有效 DPI内容感知资源清理产物回读校验

能力速查

以当前产品实现为准,不把路线图当成已上线功能。

处理位置
浏览器本地;不经过 HTML 重建
判定依据
横纵双向有效 DPI + 实际资源使用
结构优化
内联图片、未用资源、内容流合并与 Flate 竞速
明确边界
不做字体子集化;加密 PDF 需先解除保护

DataDance 产品与工程团队核对 · 首次发布 · 最近更新

三步完成

所有关键参数在导出前确认,处理位置也会明确标注。

01

拖入 PDF

可一次拖入多个文件。解析、重编码与写出全部在当前浏览器完成。

02

选择压缩档位

屏幕 72dpi、电子书 150dpi、打印 300dpi 或只做无损结构优化;也可以直接指定目标体积。

03

预览并保存

压缩后可在页面内切换原文件与成品对比,确认无误再保存到本机。

为什么压缩 PDF 主要是压缩里面的图片?

一份 PDF 由文字、矢量图形、字体和内嵌图片组成。文字和矢量图形本身很小,字体通常几十到几百 KB,真正把文件撑到几十兆的几乎总是扫描页、照片和截图这类内嵌位图。图映先找出普通 Image XObject,也把能够安全解析的 BI / ID / EI 内联图片提升到同一处理链路,再决定每一张该怎么处理。

“有效 DPI”是什么,为什么要横纵分别实算?

同一张 3000 像素宽的图片,铺满整页和缩成名片大小,需要的分辨率完全不同;同一图片还可能跨页复用或被非等比缩放。图映解析每页和 Form 内容流、跟踪图形状态矩阵,分别汇总图片横向与纵向的最大落地尺寸,再独立决定目标宽高。只有明显高于所选档位的方向才会重新采样,已经足够的像素保持原样。缩放使用 Lanczos-3,原始 Decode 数组按颜色通道解释;需要完整色彩管理而无法证明等价的图片不重编码。

为什么不是所有图片都转成 JPEG?

JPEG 适合照片,但对截图、图表、线稿和大色块反而更大也更糊。图映复用与图片压缩同一套内容分类器判断每张内嵌图属于截图、插画、图标、平滑照片还是高纹理,然后让 JPEG、索引调色板加 Flate、灰度 Flate 和保留原图同场竞速,连调色板字典开销也计入比较,取真正更小且符合该档位质量口径的方案。

除了图片还做了什么?

图映读取实际绘制操作符,只在能够完整识别时删除未使用的字体、图片、图形状态、色彩空间、图案、着色与属性资源;遇到未知操作符或特殊流就整组保留。页面分散内容流只在词法边界安全且合并后更小时合并。未压缩、ASCII、LZW 和已经使用 Flate 的结构流都会重新与新 Flate 竞速,只有更小才替换;随后继续做不可达对象回收、重复流去重、私有数据清理、对象流和交叉引用流打包。

哪些情况图映不会动?

加密或有权限保护的 PDF 会提示先解除保护。JPEG 2000、JBIG2、CCITT 传真、CMYK 印刷 JPEG和需要完整 ICC / Lab / DeviceN 色彩管理的图片在浏览器不能可靠等价重编码时原样保留。任何图片、结构流或整份 PDF 没有实际变小,也都保留原数据。

诚实边界:图映当前不做字体子集化,因此纯文字排版 PDF 的收益仍取决于是否携带未使用资源和低效结构流。产物会回读核对页数、每页尺寸、可选择文字操作和链接语义,不一致就自动保留原文件。数字签名 PDF 一经重写签名会失效。

内容更新:2026-08-25 · 能力边界以工具内实时探测为准

常见问题

下列答案与当前产品逻辑和页面结构化数据保持一致。

PDF 会上传到服务器吗?

不会。解析、内嵌图片重编码、结构重写和校验都在当前浏览器完成,也不需要下载额外的运行库。

压缩后文字还能搜索和复制吗?

可以。图映只重编码内嵌位图并重写文件结构,不会把页面转成图片,文字层、书签和链接保持原样。

为什么有的 PDF 几乎压不动?

如果内嵌图片已经低于所选 DPI 且编码合理,或者文件本来就以文字和矢量为主,就没有可压缩的空间;这种情况下图映会如实告诉你保留了原文件,而不是靠降低分辨率制造数字。

继续了解 ImgIng 图映

相关任务页使用独立的标题、说明和可核验边界,不做只换关键词的重复页。