千谲

Capability

AI 字幕擦除

去掉画面硬字幕,背景自动补回

AI 字幕擦除是去掉视频画面里已烧录字幕的能力。它不只是打码遮盖,而是识别字幕区域后把被挡住的背景补回来,让画面看起来本来就没有字。

单个视频时长上限
60 分钟

平台视频上传校验的时长上限,支持 MP4 与 MOV。

立即使用AI 字幕擦除

擦除和打码遮盖有什么区别?

打码是往画面上再加一层东西:高斯模糊、色块、贴图。观感上一眼能看出这里被处理过,而且遮盖块会随着镜头运动显得突兀。擦除是做减法——判断字幕像素之外原本应该是什么,然后把那部分内容重建出来,最终画面里没有任何处理痕迹。

技术上的难点在时序一致性。视频是逐帧的,如果每一帧独立补全,补出来的背景在帧之间会抖动,播放时那块区域会像在沸腾。所以擦除必须参考前后帧,让补出来的内容随镜头连贯变化。

  • 素材二次利用:拿到带字幕的成片,去字后重新剪辑
  • 多语版本前置:擦掉中文硬字幕再做翻译,避免两种语言叠在一起
  • 版式更新:文案改版时不必重新拍摄,去掉旧字重新加

三种擦除方式怎么选?

智能识别是默认方式,自动检测画面下方居中的白色字幕,适合标准的短视频字幕排版,不用任何配置。Auto 加指定区域会先 OCR 识别文本,但只擦除完全落在你框选范围内的字幕——用于画面里有多处文字、只想去掉其中一部分的情况,比如保留 logo 但去掉字幕。手动框选则完全按你画的区域擦除,不做文字识别,适合要去掉的不是文字而是水印、台标这类固定元素。

判断顺序建议从上往下试:先跑智能识别看结果,识别不全或误伤了要保留的文字,再改用带区域限定的方式。

什么样的字幕最难擦干净?

难度取决于字幕底下的背景有多复杂。纯色背景、虚化背景上的字幕擦除后几乎看不出痕迹;压在人脸、复杂纹理、快速运动的画面上的字幕,补出来的内容需要模型推断更多,边缘可能留下轻微的模糊感。

另外,带描边、带阴影、带半透明底衬的字幕比纯文字更难——要擦掉的不只是字本身,还有那圈附属效果。这类建议用手动框选把整个字幕组件框进去,而不是依赖自动识别只圈住文字。

下游通常接两件事:要出多语版本的接视频翻译,此时必须先擦后翻,否则两种语言的字会叠在一起;原片本身画质不够的先过视频高清放大,擦除时可用的背景信息更多,补出来的痕迹也更少。

使用步骤

  1. 1

    上传源视频

    支持 MP4 与 MOV,单个视频最长 60 分钟。

  2. 2

    选择擦除方式

    默认智能识别画面下方居中字幕;也可以框选区域限定范围,或完全手动指定要擦除的区域。

  3. 3

    框选区域(按需)

    选择带区域限定的方式时,在预览画面上直接框出范围。带描边与底衬的字幕建议整块框进去。

  4. 4

    生成后检查

    重点看字幕原位置在播放时是否稳定,以及复杂背景处有没有残留痕迹。确认干净后再接视频翻译出多语版本。

常见问题

能擦掉水印和台标吗?
可以。用手动框选方式指定区域即可,这种方式不做文字识别,按框选范围直接擦除。
擦除后画面会有痕迹吗?
取决于字幕底下的背景。纯色与虚化背景几乎无痕;压在人脸、复杂纹理或快速运动画面上的字幕可能留下轻微模糊。
带描边和阴影的字幕怎么处理?
建议用手动框选把整个字幕组件(含描边、阴影、半透明底衬)框进去,只圈住文字会留下附属效果的残影。
视频有时长限制吗?
单个视频最长 60 分钟,支持 MP4 与 MOV。

术语

视频修复
把视频中被遮挡或损坏的区域按周围内容重建出来的技术,英文常称 Video Inpainting。
时序一致性
相邻帧之间补全结果的连贯程度。缺乏时序一致性时,被修复的区域在播放中会出现抖动或沸腾感。
硬字幕
已经烧录进视频画面、无法通过播放器关闭的字幕。软字幕则是独立轨道,可以直接替换。

相关能力