导入视频并选背景
导入 MP4、WebM 或 MOV,选择透明、纯色、背景图或虚化原景;画面不拉伸、不裁切。
视频不用上传。Beta 测试版优先支持桌面 Chrome / Edge;模型按需从 ModelScope CDN 下载并校验,失败时自动回退本站。解码、抠像、背景合成、编码和音频封装都留在设备中。
以当前产品实现为准,不把路线图当成已上线功能。
DataDance 产品与工程团队核对 · 首次发布 · 最近更新
所有关键参数在导出前确认,处理位置也会明确标注。
导入 MP4、WebM 或 MOV,选择透明、纯色、背景图或虚化原景;画面不拉伸、不裁切。
可选 7.2 MB RVM 兼容模型、51.3 MB RVM 质量模型,或由 RVM ResNet50 校准首帧后再传播的 MatAnyone2 非商业测试模型。
逐帧时序抠像后由 WebCodecs 编码,把原音频重新封装;不透明背景默认 MP4,透明背景使用 WebM。
独立处理每帧容易让发丝和半透明边缘在前后帧之间闪烁。图映的 RVM 路径使用循环状态记住时间信息,并在检测到镜头切换时重置状态;实验极致档先用 RVM ResNet50 校准首帧发丝和完整轮廓,再交给 MatAnyone2 记忆模型传播,以降低首帧漏抠、抖动和上一镜头残留。
RVM MobileNetV3 FP16 约 7.2 MB,适合快速预览、普通电脑和较长视频;RVM ResNet50 FP16 约 51.3 MB,细节更稳但处理更慢;MatAnyone2 会根据原视频比例自动匹配横屏、方形或竖屏模型,当前比例档约 294 MB,并复用 51.3 MB RVM ResNet50 做首帧校准,合计约 345 MB,仅限非商业测试。所有模型优先从 ModelScope CDN 下载,失败时自动使用本站同版本备用文件,校验通过后写入浏览器缓存。
不会。编辑器保留原始画面比例与导出尺寸,不把输入强制补成方形,也不为模型裁掉画面;MatAnyone2 只在内部分析阶段选择有效像素最多的横屏、方形或竖屏输入档,首帧校准对超高分辨率等比限制到 1920 长边以控制内存,最终导出尺寸不受影响。背景图可独立选择铺满或完整显示。
实验档不会因为第一帧暂时没有主体就终止整段导出;这些帧先输出所选背景,并继续逐帧寻找主体,识别到人物后再建立时序记忆。镜头切换时也会清理上一段记忆并重新校准。
当前桌面 Chrome 和 Edge 是主要支持目标,需要 HTTPS 或 localhost、安全上下文、WebCodecs 与 WebAssembly。RVM 使用稳定的 WASM 推理路径;MatAnyone2 优先 WebGPU 并可回退 WASM。旧电脑、手机、超长或 4K 视频可能很慢,因此界面会先做能力检测,并持续显示下载、处理进度和预计剩余时间。
Beta 边界:请先预览当前帧,再处理完整视频。复杂遮挡、快速运动、半透明物体和镜头切换仍可能出现边缘误差;“保持所有比例”指不拉伸、不裁切,不代表每一种极端内容都能得到完全相同的抠像精度。透明视频导出为 WebM VP9 Alpha;MP4 不支持透明通道,适用于纯色、背景图或虚化后的不透明画面。
内容更新:2026-08-20 · 能力边界以工具内实时探测为准
下列答案与当前产品逻辑和页面结构化数据保持一致。
不会。完整视频编辑链路在浏览器本地完成,网络只用于首次下载运行库和所选模型。
它按视频比例加载一套约 294 MB 的高清时序记忆模型,并复用约 51.3 MB 的 RVM ResNet50 校准首帧,总计约 345 MB;处理时间更长且仅限非商业测试。
默认保留。兼容时直接复制,否则重编码为 WebM 的 Opus 或 MP4 的 AAC 后重新封装。
相关任务页使用独立的标题、说明和可核验边界,不做只换关键词的重复页。