拖入 PDF
可一次拖入多个文件。解析、重编码与写出全部在当前浏览器完成。
图映不把 PDF 转成 HTML 或整页图片,而是在本机直接优化原文档结构:逐张处理内嵌图,并根据实际绘制内容回收未使用资源;页面尺寸、文字、链接与矢量图形保持原样。
以当前产品实现为准,不把路线图当成已上线功能。
DataDance 产品与工程团队核对 · 首次发布 · 最近更新
所有关键参数在导出前确认,处理位置也会明确标注。
可一次拖入多个文件。解析、重编码与写出全部在当前浏览器完成。
屏幕 72dpi、电子书 150dpi、打印 300dpi 或只做无损结构优化;也可以直接指定目标体积。
压缩后可在页面内切换原文件与成品对比,确认无误再保存到本机。
一份 PDF 由文字、矢量图形、字体和内嵌图片组成。文字和矢量图形本身很小,字体通常几十到几百 KB,真正把文件撑到几十兆的几乎总是扫描页、照片和截图这类内嵌位图。图映先找出普通 Image XObject,也把能够安全解析的 BI / ID / EI 内联图片提升到同一处理链路,再决定每一张该怎么处理。
同一张 3000 像素宽的图片,铺满整页和缩成名片大小,需要的分辨率完全不同;同一图片还可能跨页复用或被非等比缩放。图映解析每页和 Form 内容流、跟踪图形状态矩阵,分别汇总图片横向与纵向的最大落地尺寸,再独立决定目标宽高。只有明显高于所选档位的方向才会重新采样,已经足够的像素保持原样。缩放使用 Lanczos-3,原始 Decode 数组按颜色通道解释;需要完整色彩管理而无法证明等价的图片不重编码。
JPEG 适合照片,但对截图、图表、线稿和大色块反而更大也更糊。图映复用与图片压缩同一套内容分类器判断每张内嵌图属于截图、插画、图标、平滑照片还是高纹理,然后让 JPEG、索引调色板加 Flate、灰度 Flate 和保留原图同场竞速,连调色板字典开销也计入比较,取真正更小且符合该档位质量口径的方案。
图映读取实际绘制操作符,只在能够完整识别时删除未使用的字体、图片、图形状态、色彩空间、图案、着色与属性资源;遇到未知操作符或特殊流就整组保留。页面分散内容流只在词法边界安全且合并后更小时合并。未压缩、ASCII、LZW 和已经使用 Flate 的结构流都会重新与新 Flate 竞速,只有更小才替换;随后继续做不可达对象回收、重复流去重、私有数据清理、对象流和交叉引用流打包。
加密或有权限保护的 PDF 会提示先解除保护。JPEG 2000、JBIG2、CCITT 传真、CMYK 印刷 JPEG和需要完整 ICC / Lab / DeviceN 色彩管理的图片在浏览器不能可靠等价重编码时原样保留。任何图片、结构流或整份 PDF 没有实际变小,也都保留原数据。
诚实边界:图映当前不做字体子集化,因此纯文字排版 PDF 的收益仍取决于是否携带未使用资源和低效结构流。产物会回读核对页数、每页尺寸、可选择文字操作和链接语义,不一致就自动保留原文件。数字签名 PDF 一经重写签名会失效。
内容更新:2026-08-25 · 能力边界以工具内实时探测为准
下列答案与当前产品逻辑和页面结构化数据保持一致。
不会。解析、内嵌图片重编码、结构重写和校验都在当前浏览器完成,也不需要下载额外的运行库。
可以。图映只重编码内嵌位图并重写文件结构,不会把页面转成图片,文字层、书签和链接保持原样。
如果内嵌图片已经低于所选 DPI 且编码合理,或者文件本来就以文字和矢量为主,就没有可压缩的空间;这种情况下图映会如实告诉你保留了原文件,而不是靠降低分辨率制造数字。
相关任务页使用独立的标题、说明和可核验边界,不做只换关键词的重复页。