部分桌面 4K H.264 精细压缩在内存不足后恢复更快;符合条件的 4K HDR H.265 与 H.264 High 10 视频也能恢复处理,保持原有位深、色彩和画质设置。原本正常完成的编码不变。
每一步做成什么,下一步准备做什么
这是一份面向用户的公开产品记录:只收录可直接使用或感知的变化,已交付能力按日期列出,未来计划单独标记。内部部署、运维和验证信息不会混入其中。
下一版本计划支持 Markdown(MD)转 HTML、图片和 PDF,便于阅读、分享与打印。
已经交付
以下只记录用户已经可以使用或感知的功能、修复和体验变化,不包含设想或内部工程信息。
部分 4K 高保真压缩可在内存不足后继续处理
适用桌面的部分 8-bit 标准色彩 H.264 视频,在既有处理方式内存不足时恢复更快,保持原尺寸、帧率和既有备用路线的画质设置。符合条件的 4K、10-bit PQ/HLG H.265 与 H.264 High 10 视频也可在原有路线内存不足后恢复,保留原有位深、HDR 色彩与画质设置,不需要重复下载一份大型编码器。恢复可取消,清空后可继续处理其他视频;成品仍按实际体积与当前档位规则决定是否采用。原本正常完成的编码与其他画质档位不变。
高保真转换更准确地保留源视频色彩,连续处理更稳定
本地 H.264 High 10 与 H.265 高保真转换不再统一覆盖色度采样位置或将已知 BT.601、广色域 SDR 视频标为 BT.709;修正全范围视频转换时明暗范围被缩窄的问题,减少播放器还原色彩和明暗时的偏差。部分 4K H.265 视频会采用更低的缓冲并发,减少内存不足造成的失败,不靠降低分辨率或更改画质档位完成。高分辨率 H.264 计算队尾画面时允许更合理且有上限的等待,减少误中止与重复处理;单个视频内存不足也不再让后续任务持续使用较慢的备用路线。现有压缩档位、帧率与色调处理策略不变;有损转换不等于逐像素还原,未知色彩或不同 HDR 设备的显示仍可能存在差异。
保持原帧率时不再因帧率信息遗漏而异常增大
视频压缩与视频抠像导出现在会将实际帧率用于编码预算,同时保留原画面时间戳;可变帧率视频不会因此被强制补帧或变成固定帧率。智能推荐在全画面复核之外,增加片头和原尺寸局部纹理检查,减少缩小预览掩盖细节损失的情况。已有画质档位、HDR 色彩与位深保留策略不变;结果仍会显示真实生成大小,未达到节省标准或未通过画质复核时保留原片。输出设置新增可选精细软件编码,适用于色彩信息完整且处于本地处理安全范围的 8-bit BT.709 H.264 视频;保持默认路线不变,以更长处理时间进行更充分的压缩搜索。首次按需获取共用核心,原视频不上传;实际体积与当前档位的采用标准仍然有效,不保证每个文件都更小。
H.265 原片按源位深优先同源压缩,并以真实体积与画质复核决定是否采用
智能推荐现在以正常观看时无明显画质差异为第一标准,会结合纹理、低对比度渐变、运动峰值、画面变化和源码率设置动态预算,并在快速横移、战斗画面或大幅转场中缩短关键帧间隔。低码率分析只用于提示重复编码风险,不再直接判定“无需压缩”;智能推荐会完成真实转码并显示实际成品大小,只有节省达到采用标准且代表画面复核通过时才保留成品。成品变大、节省不足或画质复核未通过时,会分别说明原片大小、实际生成大小和未采用原因,并完整保留原视频。H.265 输入会严格匹配源位深:设备具备对应硬件能力时优先硬件压缩;硬件不可用时,安全范围内按需启用本地 H.265 Main / Main 10 高保真压缩,继续保留原 HDR 曲线与色彩信息;只有本地路径也不可用时才转为兼容 H.264 或保留原片。所有档位均不会放大原分辨率或补高原帧率;完成后可清空视频、预览和结果并释放内存。
视频压缩正式开放并默认保存为 MP4
支持导入 MP4、M4V、MOV、WebM 和 MKV,并继续检查文件内部的真实视频与音频编码;当前浏览器能够解码时,画面、音频和成品都留在本机。智能推荐、肉眼近无损、体积优先和极致压缩四档会根据分辨率、帧率、源码率与所选编码器分配数据,始终保持原始画面比例,不拉伸;分辨率、帧率和音频也可独立调整。默认输出 H.264 / AAC MP4,适合手机、电脑和常见平台;也可输出 VP9 / Opus WebM,设备能力检测通过后还可使用 AV1 / Opus WebM。长视频支持实时进度、预计时间、暂停、继续和取消;支持直接写入用户选择的文件,浏览器不支持直接写入时会在完成后弹出推荐文件名与保存位置。中文、英文、日文、韩文、德文、西班牙文、葡萄牙文和法文均提供完整工作台。
新增浏览器本地 AI 变高清
图片处理区新增 AI 变高清入口。Real-ESRGAN 与 SwinIR 模型首次按需下载并校验,之后直接读取浏览器缓存;原图、分块和高清结果都留在当前设备。快速高清适合照片、商品图与普通图片,保真高清优先保护文字、建筑和线条结构,老照片增强会保守恢复对比度、褪色与细节,双模型自然精修会兼顾人物与背景材质的连续细节,但不会把推测生成的人脸当作真实还原。支持 2× 与 4×,大图自动使用带重叠区域的分块推理,避免接缝并控制内存;移动端默认 2× 并限制最终像素,处理完成、换图、退出或清空时会释放图片、结果、推理会话和 Worker。可比较原图与增强结果,并按实际生成的 WebP、PNG 或 JPG 类型保存。中文、英文、日文、韩文、德文、西班牙文、葡萄牙文和法文均提供完整工作台。
PDF 页面、原始图片和图文内容都可独立提取
PDF 转图片支持指定单页、全部页面或整份拼接长图,按 144、216 或 300 DPI 生成 WebP、JPG、PNG 或 AVIF,并使用内容感知画质推荐;超长和复杂页面按安全高度分片后无缝合成,不裁页、不拉伸。PDF 图片提取会寻找页面实际使用的内嵌资源,可安全复用的 JPEG 与 JPEG 2000 保留原始压缩字节,共享图片自动去重,不用整页截图代替素材。PDF 内容提取会同时读取原生文字层、页面中的混排图片以及图片内部 OCR 文字,默认自动选择适合设备的模型,也可在桌面选择极速、专业或极致档;结果按页面位置和阅读顺序合并,隐藏 OCR 文字层与图片识别结果自动去重,可保存为一个长页 HTML、TXT 或 Markdown。任务区可直接选择另一份 PDF,确认新文件后会替换当前内容,无需先手动清空;连续处理多个 PDF 后,内存占用会在完成、换文件、关闭或清空时及时回落,不需要刷新页面。PDF、图片和识别文字均不上传。HEIC、JPEG、PNG、WebP 与 AVIF 等源图片在转换为 JPG、PNG 或 WebP 时,会继续携带原文件已有的拍摄时间、相机型号、GPS、色彩配置和版权信息;方向与尺寸会按转换结果校正。
DOCX 与 PPTX 可转换为一个离线只读 HTML
DOCX 转 HTML 会尽量保留文字、列表、表格、图片、分页、页眉页脚、脚注与尾注;PPTX 转 HTML 会按原始幻灯片比例重建文字、图片、形状、表格、图表、SmartArt 和背景。导入后即可直接预览,保存前可确认推荐文件名与位置;输出只有一个自包含 HTML,正文无需脚本即可阅读,不附带 Office 原文件和转换器。成品提供逐页导航、缩放、适合宽度、查找、全屏与打印。宏、动画、切换、视频、3D、嵌入程序和无法等价呈现的复杂对象不会执行,会使用可用的静态外观或明确提示对应页面需要核对。首页入口同时按图片处理与创作、PDF 文档处理、Office 文档转换和视频智能处理四组展示,八种语言保持统一字号、等高和完整标题;关闭工具、切换文件或离开页面后内存回收更及时,多次连续处理更稳定。
新增多语言图片 OCR 工作台
首页任务区与左侧快捷菜单均在第一位置提供带“新”标识的图片文字识别入口。极速档支持中文、英文、德文、西班牙文、葡萄牙文和法文;专业与极致档增加日文。模型优先从公共下载地址获取,不可用时自动切换本站同版本文件,校验完成后复用浏览器缓存。结果按文字框位置重建视觉行、段落和表格列,复制与 TXT 会换行保留原图行,并用 Tab 分隔表格列;复制完成会立即显示清晰的成功提示。连续规则列可导出 Markdown 表格,JSON 继续保留原文、校对文字、坐标和置信度。右侧改为紧凑版面预览与可折叠逐行校对。当前统一模型不含韩文,也不把任意手写体和公式语义宣传为可靠能力。
动图工坊缩小 GIF 与 APNG 差分体积并改进多格式默认
GIF 会安全保存局部变化,透明轮廓发生变化时自动使用整帧清屏,避免重影;恰好占满 256 色的动画也不会为了差分牺牲真实颜色。当前 685×150、134 帧样本的默认 GIF 与 APNG 均约 1.17 MB,134 帧逐帧像素与原动图一致;同一 APNG 使用完整帧时约 6.55 MB。高帧数且颜色接近 GIF 上限的素材默认改选更适合的动图 WebP,多格式 ZIP 也会遵守用户选择的差分帧或完整帧。
视频抠像在保持当前高质量效果的同时缩短重复等待
先预览视频第一帧并确认效果后,完整导出会直接沿用已经建立的高质量首帧蒙版与时序状态,从下一帧继续处理,不再重复执行一次最耗时的首帧校准。逐帧处理减少了不必要的画面复制和重复内存准备,进度与成品预览按稳定节奏更新,长视频处理时页面更流畅。实验极致模型、RVM ResNet50 首帧发丝校准、10 轮首帧精修、每 5 帧时序记忆更新、镜头切换重建、原比例分析尺寸和最终输出像素均保持不变。
AI 抠图在手机微信和电脑端均可正确启动本地推理
首次进入 AI 抠图时,手机微信与电脑浏览器现在都能正确加载并启动本地推理,不再因资源地址无法解析或模型下载完成后推理后端初始化失败而中止。手机端继续只开放内存更安全的快速 AI,电脑端保留快速、专业与骨灰级模型;模型仍优先从公共下载地址获取,不可用时自动切换本站备用地址,已完成的模型会继续从浏览器缓存读取。
PDF 压缩重新进入后从离开的位置继续
PDF 压缩现在会在关闭视窗后保留当前文件、压缩档位、预览方式和已生成结果;重新进入即可恢复有效预览,不再显示文件损坏。右侧逐张图片的处理清单会利用高屏幕的全部剩余空间,较矮窗口则保持可滚动,完成后的压缩信息不会再在下方仍有空白时提前截断。
HTML 转 PDF 保留更多可缩放图表、表格与文字
HTML 转 PDF 现在会在保持页面外观的前提下,避免常见阴影把整张图表、整块表格或成片文字转成图片;不能确认等价的复杂效果仍按原样保留。无损最小化能力与页面转换并行准备,并会在同一次写出中递归合并完全相同的图片与透明蒙版,不再需要把成品重新放入 PDF 压缩才能发现下一层结构收益。当前 14 页复杂图表报告样本中,页数、尺寸、背景、水印和阴影保持不变,可提取文字由约 1297 字增至约 2716 字,一次自动优化后的文件由约 4.82 MB 降至约 1.56 MB,页面生成由约 5.3 秒降至约 2.6 秒。实际收益取决于网页内容;Canvas、真实图片和必须栅格化的复杂效果仍会作为像素内容保存。
PDF 转 HTML 在完整还原页面的同时显著缩小单文件体积
本地固定版式引擎升级至 1.3:重复出现且可安全共享的矢量组件、路径和显示样式在整份文档中只保存一次,获准嵌入的 TrueType / OpenType 字体改用无损 WOFF 容器。处理不会降低图片质量、不会把页面栅格化,也不会删除或替换获准字体;不能确认等价的复杂组件继续按原结构完整展开。当前 15 页复杂图表报告样本从 12,719,382 字节降至约 4.75 MB,15 页、29 套嵌入字体、可选择文字与全部图表保持可用;不同 PDF 的收益取决于其中可重复内容的多少。成品仍是可离线直接打开、没有查看器菜单的单个 HTML。
新增西班牙语和葡萄牙语完整界面
语言顺序统一为“中文 / EN / 日本語 / 한국어 / DE / ES / PT / FR”。西班牙语和葡萄牙语不仅提供首页,还完整覆盖图片与视频工作台、PDF 压缩、PDF 转 HTML、HTML 转 PDF、任务指南和版本轨迹。首次访问会从浏览器的完整语言偏好中识别 es 与 pt 的常见地区变体;明确语言网址和用户手动选择始终优先。宽屏显示完整名称,空间收紧时切换为短标签,桌面与手机端都保持单行,不遮挡品牌、主题按钮或功能入口。
在线做图升级为多页设计工作台
在线做图工程可保存最多 24 个独立页面,每页拥有自己的画布尺寸、背景、图片、可编辑多语言文字与滤镜。画布预设会与实际宽高实时匹配,非标准尺寸明确显示为自定义。文字字体按需载入后会立即刷新,切换字体只修改当前选中的文字图层,不再带动其他文字变化。现有单页图片导出保持不变,同时新增全部页面逐页 ZIP 和可独立打开的高清多页 HTML。开放 .imging 工程升级到 v3,保存全部页面并兼容已有 v1、v2 工程;已有 v3 工程内容也可继续打开和编辑。中文、英文、日文、韩文、德文和法文界面同步提供完整操作。
移动端 AI 抠图新增微信安全模式与统一内存保护
微信、iPhone、Android 等移动浏览器会在下载前判断可用模型:快速 AI 保持可用,专业 AI 与骨灰级 AI 明确标注为电脑端并在选择时说明原因,不再下载高内存模型后才失败。超大照片会保持原比例并按当前移动设备的安全像素预算生成透明结果,不裁切、不拉伸;紧凑预览、专业精修、背景合成、快速去底色和最终导出共用同一安全尺寸,防止后续步骤重新创建超大画布。移动端模型卡片、处理方式、进度状态、预览和蒙版工具均增大字号与触控面积;图片继续只在本机处理。桌面端仍保留全部模型和原始分辨率输出。
首次访问按完整语言偏好顺序精确进入六语言页面
中文、英文、日文、韩文、德文和法文均识别其常见国家、地区与书写变体;浏览器第一偏好尚未支持时,会继续查找后续偏好并进入其中第一个受支持的界面,只有整个列表都不受支持时才默认英文。用户已经手动选择的语言以及明确打开的语言网址始终优先,不会因所在国家、代理网络或浏览器后续判断而被改写。首页与图片、视频、PDF、PDF 转 HTML、HTML 转 PDF 快捷入口采用同一规则。
PDF 转 HTML 与 HTML 转 PDF 统一升级为正式入口
首页快捷卡片、左侧工作台入口、工作台标题、功能介绍和任务说明不再把 PDF 转 HTML、HTML 转 PDF 标记为 Beta;中文、英文、日文、韩文、德文和法文保持一致。此次调整只改变当前功能的发布状态展示,不隐藏固定版式还原、浏览器兼容性与服务端 Chromium 转换等真实边界;视频抠像仍保持 Beta 标识。
图片导出、在线做图与高级精修统一支持多语言文字图层
普通图片压缩与格式导出继续提供可拖动文字水印,并新增覆盖中英日韩德法的字体选择;在线做图新增独立可编辑文字图层,可调整内容、字体、字号、颜色、对齐、行高、透明度、缩放、旋转、层级与 2.5D 效果;AI 抠图后的高级精修也新增可直接拖动的文字水印层。中文使用阿里妈妈数黑体,英文、德文、法文及其他拉丁语言使用 Noto Sans,日文和韩文分别使用对应 Noto CJK 字体;字体仅在首次选中时按需下载并缓存。预览、全尺寸导出和专业精修成品等待同一字体就绪,不会出现预览与保存字体不一致。.imging 开放工程升级到 v2,保存可读文字参数并兼容 v1 图片工程,接力编辑不需要把文字栅格化。HTML 转 PDF 完成后会锁定已经用于生成 PDF 的预览画面,阻止源页面悬停脚本继续改变显示;全屏工作台打开时也会暂停被遮住的首页装饰动画。
新增韩语与法语完整界面,形成六语言统一体验
顶栏语言顺序统一为“中文 / EN / 日本語 / 한국어 / DE / FR”,宽屏显示完整名称,窄屏使用单行短标签。韩语和法语不是只有首页按钮:两种语言都具备首页、图片与视频工作台、PDF 压缩、PDF 转 HTML、HTML 转 PDF、十二类任务指南和版本轨迹。明确语言网址始终优先;首次访问首页或五个工具快捷路径时,韩语、法语浏览器会进入对应完整界面,其他未支持语言仍默认英文。切换后,打开工具、关闭、按 Esc 和浏览器后退都会保持当前语言。
中英日德独立选择、完整页面与浏览器语言智能入口
顶栏提供中文、EN、日本語和 DE 四个独立选择项,当前页面始终具有明确选中状态;窄屏自动使用“中 / EN / 日 / DE”短标签,保持单行且不挤压品牌和主题按钮。用户手动选择会被浏览器记住并优先于自动判断;语言链接同时携带一次性显式选择,使隐私模式或内嵌浏览器禁用存储时也不会跳回原语言,临时参数读取后立即清理。首次访问首页或 /img、/video、/pdf、/pdf-html、/html-pdf 快捷入口时,中文、日文、德文浏览器分别进入对应界面,其余语言默认英文;明确打开任何语言 URL 时始终尊重该网址。四种语言均提供完整工作台入口、任务说明、版本记录与对应语言链接。
PDF 压缩:双向有效 DPI、内联图片与内容感知结构清理
PDF 压缩继续使用原文件结构,不经过 HTML 重建。图片分析会分别汇总同一对象在所有页面上的横向与纵向落地尺寸,非等比缩放也按两个方向独立决定目标像素;原始像素的 Decode 数组按通道解释,特殊色彩空间无法证明等价时保持原样。页面里的 BI / ID / EI 内联图片会在安全可解析时提升为标准 Image XObject,进入与普通内嵌图相同的内容分类、有效 DPI 和编码竞速链路。结构优化会根据实际绘制操作符清理未使用的字体、图片、图形状态、色彩空间、图案、着色与属性资源,遇到未知操作符或特殊流则整组保留;分散的页面内容流只在词法边界安全且确实更小时合并。已经采用 Flate 的结构流也会重新竞速,只有更小才替换。产物继续回读核对页数、页面尺寸、可选择文字和链接语义,不一致或整份文件没有变小就自动保留原 PDF。
工作台关闭后可靠恢复首页地址与当前语言
修复在线做图、视频扣像、PDF 压缩、PDF 转 HTML 与 HTML 转 PDF 在导入、预览或处理内容后,关闭了界面但地址仍停留在工具快捷路径的问题。现在无论从首页进入还是直接打开快捷地址,点击 X、按 Esc 或使用浏览器后退都会同步退出工作台并恢复中文 / 或英文 /en/ 首页;随后刷新仍停留在首页,不会重新打开已经退出的工具。
HTML 转 PDF:真实页面、通用无损矢量与字体资源最小化
HTML 转 PDF Beta 保持“导入即预览 → 明确转换 → 自动最小化 → 直接保存”。单 HTML 立即显示原页面,完整目录可授权相对 CSS、图片、字体、脚本和数据文件;只有点击转换后才稳定 document.fonts、图片、图表和 Canvas,并按 CSS @page、固定版式逐页元数据或完整渲染宽高生成真实页面,不暗中套用 A4。默认优化改为通用无损模式:不识别某一种图表或固定 SVG,而是在 PDF 内容流层把数学上完全相同的填充路径提升为共享 Form,调用处的变换、颜色、透明度和裁剪保持不变;可见中英文字体完全保留,只有每次使用均可证明为不可见且不参与文字裁剪的 Type 3 字形绘制才精简为原始度量。图片像素默认不重采样、不重编码,打印 300 dpi、电子书和屏幕档改为用户主动选择。写出后回读核对页数、每页尺寸、可选择文字操作和链接语义,不一致或没有更小都自动保留 Chromium 原文件。结果显示前后体积和推荐文件名,再写入系统保存位置;不打开打印机,也不要求回选 PDF。转换期间顶部按钮保持固定宽度和固定状态文案,详细阶段只在进度面板更新,不再带动右侧操作区闪动或重排。字体、图片、动态图表与最终页面尺寸改在不可见的隔离画面中准备,中央原始 HTML 预览从点击到保存始终不重载,首次转换不再出现整页白闪或类似刷新的跳变。即时预览补齐 eval、WASM 与 Worker 型单文件页面的沙箱运行能力,并在真正加载完成前显示明确的打开状态,不再把尚未渲染的白画面误报为预览完成。字体与图片等待阶段现在持续显示真实完成数、等待秒数和活动进度,并明确区分本机解码与联网下载;动态页面直接复用首次隔离渲染测得的真实尺寸,不再为测量页面重复加载整份字体和图片。固定版式页面不再通过比例反算打印高度,而是逐页沿用 HTML 元数据中的真实尺寸;保存前还会核对页数和每页页面框,避免尾部出现空白页或尺寸漂移。转换排版能力会提前就绪并在任务间安全复用,小页面不再每次重复经历固定启动等待;没有 Web 字体或图片需要解码时会立即继续,进度也不再误报成正在下载字体。
PDF 转 HTML:跨版本、蒙版、颜色与逐页质量报告增强
本地固定版式引擎升级至 1.2:修复真实演示文稿中渐变方向错误和带 SMask 的 JPEG 图片缺失;新增一位 ImageMask、内联图片、JPEG 软蒙版、常见图形状态 Alpha / Luminosity 软蒙版、ICCBased 回退、Indexed 调色板、径向渐变,以及注释和表单的标准静态外观流。字体字重与斜体按 FontDescriptor 保留,软蒙版内容和 Type 3 字形跨页复用。质量报告新增问题代码到具体页码的映射,中英文工作台会直接显示连续页码范围;CMYK JPEG、自定义 Decode、颜色键蒙版、JPEG 2000、特殊软蒙版传递函数或 Matte 预乘色等不能完全等价的情况不再静默通过。
视频抠像:统一产品定位与实验室级质量说明
首页快捷入口、视频工作台、双语任务页与页脚统一使用“视频抠像 / Video Matting”。质量定位升级为实验室级 Beta,明确说明 MatAnyone2 极致档在当前内部代表性样片、已对比的同类浏览器端方案中取得最佳综合抠像效果;同时保留严谨边界:这是阶段性、有范围的内部测试结论,不是对所有素材、设备和行业产品的绝对排名。原有 /video 与 /video-editor/ 地址继续可用。
PDF 转 HTML:渐变坐标、矢量体积与渐进完整预览增强
增强本地 PDF 转纯净 HTML 引擎:Type 3 字体不再一律降级为替代字体,而是读取 CharProcs 原始绘制指令,按实际轮廓在整份文档中共享 SVG 字形,并叠加透明可选择文字层;PatternType 1 平铺图案与 PatternType 2 轴向渐变使用 PDF 已给出的绝对图案矩阵,不再重复乘当前绘图矩阵,修复 Chrome / Skia 生成的演示文稿中柱状图渐变错位并退化成深色的问题。真实 15 页测试文件的重复 Type 3 定义由 3625 份降到 1012 份,输出由约 6.3 MB 降到约 4.38 MB;工作台新增体积解释,说明 PDF 压缩内容流展开为无脚本、可直接显示且文字可选择的 SVG 后,复杂矢量文档仍可能大于原文件。预览链路由 Web Worker 先交付第一页,再沿用同一次解析在后台完成其余页面;原预览区会自动升级为可滚动的完整正文,不需要另开 PDF,正式生成还会直接复用后台结果。完整 HTML 使用离屏页面按需渲染,关闭工作台立即卸载渲染文档,同时保留打开原 PDF 对照入口。
PDF 转 HTML:固定版式正文、字体合规与无菜单成品
首页新增 PDF 转 HTML Beta 入口与 /pdf-html 中英文快捷路径。自研引擎在本机解析页面框、旋转、内容流、图形状态、文字矩阵、ToUnicode、矢量路径、图片、表单与链接;普通页面重建为固定版式 SVG,文字保持可选择。TrueType / OpenType 字体读取 OS/2.fsType,仅内联获准嵌入的字体,Restricted License 和 bitmap-only 字体不会被复制。导出的单个 HTML 只内联页面正文所需的 CSS、SVG、图片与字体,不加载外部资源、不执行 PDF JavaScript,也不加入缩放、报告、打印、下载原 PDF 等查看器菜单。JPEG 2000、网格渐变、文字裁剪或复杂表单等非等价特性仍按页写入转换工作台的质量报告,方便保存前对照原文件验收。成品支持离线打开,并在保存时提供推荐文件名。
导出、下载与工程保存统一使用系统保存窗口
图片转换与压缩、AI 抠图、动图单格式与三格式打包、在线做图成品、开放 .imging 工程、视频换背景和 PDF 压缩全部接入统一保存链路。支持 File System Access API 的桌面 Chrome / Edge 会显示系统保存窗口、推荐不会误覆盖原文件的名称,并让用户确认存放位置;耗时的做图、工程、动图打包和视频任务会在编码前选好目标。微信、iPhone、Safari 与 Firefox 等不支持目录选择的环境继续使用兼容下载,并明确提示到浏览器下载记录或“文件”App 查找。
快捷路径恢复与 PDF 队列内存保护
直接访问 /img、/pdf 及对应英文地址现在会可靠打开目标工作台。PDF 批量导入不再一次性读取全部文件,而是在处理当前文件时才载入;根据设备内存限制单文件、队列总体积和文件数量,处理后释放源字节,保留原文件时直接复用 File,并新增“清空队列并释放内存”,降低手机与大批量文件导致页面被系统终止的风险。
PDF 压缩:按有效 DPI 逐张重编码内嵌图片
在线视频编辑入口下方新增同款 PDF 压缩工作台。自研 PDF 引擎在本机解析 xref 表、xref 流与对象流,解析每页内容流跟踪图形状态矩阵,算出每张内嵌图真实落地的有效 DPI;只有高于所选档位的才用 Lanczos-3 重采样。每张图复用图映已标定的内容分类器判定类型后,让 JPEG、索引调色板 Flate、灰度 Flate 与保留原图同场竞速取最小者,决策逐张可见。写出时做可达性回收、未压缩流重新 Flate、私有数据与缩略图清理和对象流重打包,最后回读核对页数与每页尺寸,不一致即退回原文件。提供屏幕 72dpi、电子书 150dpi、打印 300dpi 与无损结构四档,可指定目标体积;PDF 与内嵌图全程不上传,也不需要下载额外运行库。不做字体子集化,纯文字 PDF 收益有限;加密 PDF、JPEG 2000、JBIG2 与 CMYK 印刷 JPEG 一律原样保留。
转换、压缩与导出共用的专业水印图层
可直接输入中文、英文或品牌文字,也可上传透明 PNG / WebP Logo;在小画布中像图层一样拖动定位,并用控制点缩放和旋转。颜色、透明度、快速位置、平面或 2.5D 柔光立体效果均可调整,最终按原图分辨率本地重绘;未启用时不改变现有编码、缓存和同格式保留原文件逻辑。
首页入口文字与移动端可读性提升
提高任务标题、格式说明、NEW / BETA 徽标、三条使用承诺、折叠说明和品牌联系信息的字号,并同步增加卡片高度与内部留白。手机双列布局允许较长标题显示两行,避免放大后出现截断、拥挤或错位。
分格式、分内容的小体积智能默认
参考 Squoosh 与各编码器官方基线,分别降低普通照片、平滑照片、纹理、图文和软透明边缘的推荐值;JPEG 继续为浏览器原生编码保留额外余量,WebP 透明通道保持 Alpha 100 无损。AVIF 对常见手机大图使用更高压缩效率档,同格式原尺寸压缩仍会在结果不更小时自动保留原文件。
首页首屏清爽化与核心任务直达
保留原有双栏结构和完整转换器,将首屏信息顺序调整为“先选任务、再看说明”:六个入口直达转换、压缩、AI 抠图、动图工坊、在线做图与视频换背景;本地处理、免注册和无水印承诺固定可见,专业能力说明按需展开。同步降低背景装饰和卡片阴影噪音,并覆盖中英文及手机双列布局。
iPhone 微信 WebP 本地处理与移动端布局修复
WebP 原生能力现在核对真实 MIME,避免 WebKit 静默回退 PNG;缺少 Canvas WebP 编码时自动按需加载自托管 libwebp WASM,覆盖转换、同格式压缩、去背景、在线做图和动图导出,图片与帧数据均不上传。同时固定手机端文字缩放、顶部导航、模式图标和浮动工具入口的尺寸、基线与安全区。
视频纯色背景选色与即时预览修复
修复视频当前帧已经扣像后,更换颜色却隐藏结果并显示白色原视频的问题。纯色、背景图、虚化强度和背景模式现在复用已生成蒙版即时重新合成,不重复运行 AI;颜色控件同时显示真实色块和十六进制值。
在线做图专业滤镜、肤色美颜与开放工程
新增当前图片图层和整体画布两种作用范围,包含 12 组专业预设以及光线、色彩、肤色美颜和细节共 18 项精调。边缘保护磨皮不会扩大透明轮廓,Alpha 逐像素保留;大图采用重叠条带控制内存,全部参数、原始素材与带效果预览写入 .imging 工程。
视频首帧发丝、比例与空白开场修复
修复实验档首帧备用蒙版误读及轻量模型漏掉低对比发丝的问题:改用质量优先 RVM ResNet50 校准,再建立 MatAnyone2 时序记忆;窄断点只做线性时间闭合且保留原透明度。横屏、方形、竖屏和超宽视频继续保持原比例;开场暂无人物时输出所选背景并继续寻找后续主体。
编辑工作区深浅主题与滚动条统一
在线做图、在线视频和专业精修统一接入网站设计令牌,工具栏、侧栏、控件、画布、卡片与退出确认会随主题一起切换;编辑器内新增主题按钮,并修复暗色界面仍显示浅色滚动条的问题。
英文最高级视频模型状态重叠修复
视频模型卡片由绝对定位状态改为双列自适应布局;MatAnyone2 的长英文标题与“当前比例已缓存”状态可分别换行和占位,说明文字使用整行宽度。
英文首页双入口重叠修复
在线做图与在线视频入口不再依赖两组固定纵坐标,改为统一容器自动排列;英文长文案换行后仍保持稳定间距,同时保留中文与响应式布局。
图片与视频双语快捷路径
新增 /img、/video、/en/img 与 /en/video 直达入口;中文和英文用户可从首页或任务页直接进入对应工作区,关闭或浏览器后退时继续保持当前语言。
视频导出体积与码率修复
修复视频换背景后 MP4 / WebM 体积异常放大;视频按原片码率、分辨率、帧率与透明通道自适应编码,兼容音频直接复制,必要转码才使用自适应音频码率。
在线视频编辑 Beta(测试版本)
开放本地视频换背景入口:支持 RVM 双模型与按横屏、方形、竖屏自适应的 MatAnyone2,模型从 ModelScope CDN 优先下载并自动回退本站;保留原比例与音频,可导出 MP4 或透明 WebM。
动图 WebP 残影修复与帧优化开关
修复有损 WebP 差分帧混合导致的后续帧价格与文字残影;重新提供“差分帧 / 完整帧”开关,并让 WebP、APNG、GIF 与 AVIF 分别执行对应的编码路径。
图片外框缩放与任意角度旋转
上线 Keynote 式八向缩放和旋转手柄、右侧精确角度与 ±90° 快捷控制;预览、撤销重做、.imging 工程导入导出和最终图片导出完整保留旋转角度。
在线做图与独立多图层工作台
上线最多 24 层的本地做图工作区:支持多图导入、图层拖动缩放与排序、透明或纯色背景、画布预设、撤销重做,以及 PNG / WebP / JPG 全尺寸本地导出。
AI 抠图后本地多背景图层合成
专业精修支持透明、纯色或最多 12 个本地背景图层;主体和每个背景层可独立拖动、缩放、定位与排序,导出时才进行全尺寸本地合成。
完整英文界面与模型状态本地化
上线完整英文工具和 8 个英文任务指南;按钮、操作提示、帮助说明、AI 模型名称、下载进度和运行状态均提供一致的英文体验。
专业 AI 抠图、真实导出与大图性能
让预览、专业精修和下载共用全尺寸透明通道;加入 1px 画笔、连续撤销重做、空格拖动画布、黑白底验边,以及固定分割线的 Squoosh 式大图对比。
三档本地 AI 与快速去底色
加入 ISNet INT8、BEN2 FP16 和 BiRefNet HR-Matting FP16 三档按需模型;快速路径只移除从画布边缘连通进来的相近底色,保留主体内部同色内容。
动图全链路与独立工作区
完成 GIF、APNG、动图 WebP 与动图 AVIF 的压缩、合成和逐帧编辑;支持 100ms–3s 帧时长、循环、方向、拖拽排序与格式间独立状态。
能力边界与工具对比
补全浏览器能力探测、端侧与服务端处理边界,以及图映、Squoosh、TinyPNG 和云转换工具的公开对比口径。
Markdown 文档处理
下一版本计划支持 Markdown(MD)转 HTML、图片和 PDF,便于阅读、分享与打印。
MD 转 HTML
将 Markdown 文档转换为便于浏览器阅读的 HTML。
MD 转图片
将 Markdown 排版内容导出为图片,方便分享。
MD 转 PDF
将 Markdown 文档导出为便于阅读和打印的 PDF。
计划说明:上述范围是公开目标,不是当前已上线能力。日期与范围可能根据排版质量、性能和兼容性验证结果调整。
路线图原则
所有新能力都要先通过四条产品底线。
本地优先
浏览器能够可靠完成的处理不上传图片。
结果可信
预览、对比与最终下载使用同一条真实像素链路。
大图可用
缩放、拖动和编辑不因高分辨率素材失去响应。
边界透明
计划中、端侧、按需 WASM 与服务端能力分别标明。
之后准备研究
没有承诺日期的方向放在研究池,不与下一版本混在一起。
批量工作流与可复用预设
同一套尺寸、画质、命名和导出规则批量应用。
蒙版与更精细的选区
在已上线的多图层合成上继续扩展选区、蒙版与更专业的局部控制。
色彩管理与专业元数据
评估 ICC、EXIF、HDR 和跨浏览器色彩一致性。
更多端侧模型与插件式能力
在下载体积、许可、速度和效果可接受时按需接入。
关于版本和路线图
给用户和搜索引擎同一套清晰答案。
现在可以使用 MD 转 HTML、图片和 PDF 吗?
这些转换属于下一版本计划,目标为 2026 年 10 月 15 日前,尚未上线。当前可用功能以“已经交付”记录和实际工具入口为准。
这项计划支持哪些输入和输出?
计划以 Markdown(MD)文档为输入,提供 HTML、图片和 PDF 三种输出;具体支持范围将在上线时说明。
为什么公开目标日期而不是固定版本号?
当前以持续交付为主,日期比虚构的版本号更容易核对。正式发布体系稳定后再引入语义化版本。
路线图会变化吗?
会。浏览器兼容、内存占用、大图性能和导出一致性可能影响范围;变更会继续在本页明确记录。
DataDance 产品与工程团队核对 ·