使用方式与适用边界
去字幕这个功能就是把第三条路自动化:你只做框选,剩下的交给模型逐帧跑。选入素材后软件自动抽一帧画面出来,你在上面拖一个框把字幕圈住,最多可以框 16 个区域(有的片子上方有台标、下方有字幕、角上还有 ID,就分开框),总面积不超过画面的 50%。然后 LaMa 模型对每一帧的这几块区域做修复——它读周围的像素,推测被字幕挡住的地方原本应该长什么样,再把这块画面重新画出来。输出是 MP4 / H.264,源音频能直接封装就原样保留,不能就转成 AAC,声音不会丢。
真正省时间的地方是批量。在「输入视频或视频文件夹」里选一个目录,软件按文件名顺序扫描当前这一层,最多能排 2000 个视频,一次提交排队跑完,中间不用管。前提是这一批的画幅、方向和字幕位置得一致——因为整批共用同一组相对区域,竖屏和横屏混在一起框会全错位,所以不同规格要拆开分批。每次提交都会在你选的保存目录下自动建一个独立的任务目录,绝不覆盖源文件;处理到一半想停就点停止,已经出好的文件保留,没做完的临时文件自动清掉。
还有一个很实用的设计是前 3 秒真实试处理。框完之后先别急着跑整批,点「真实试处理前 3 秒」,软件会用完全一样的参数真实处理每个输入视频从 0:00 开始的最多 3 秒,导出一条 3 秒的小片让你在「任务列表」里点开看。修复得干不干净、框有没有框歪、声音在不在,3 秒就看出来了。要注意的是这 3 秒固定从视频开头算,跟你预览时拖到第几秒无关;如果你的素材开头没有字幕,可以先用视频分割截一段带字幕的短片当新输入再试。
修复不等于还原:LaMa 根据周边画面推测缺失区域,无法找回原本被字幕遮住的真实内容。人脸、密集文字和快速运动背景可能留下痕迹;逐帧修复可能闪烁。分辨率与时长越高通常越慢,先试处理短片再提交整批。首次使用需联网下载运行组件,随后可在本机处理;组件与设备要求见当前系统说明。
