使用方式与适用边界
同城矩阵的做法是把这件事拆成三样你本来就有的东西:一个装着视频素材的文件夹、一列名单(一行一条视频,可以是地区名,也可以是门店名、产品名、人名)、一段带变量的文案。文案里写成「欢迎{{文本1}}{{文本2}}的朋友,我们在{{文本3}}」,软件跑到第 7 行就把这一行的字替换进去,替换后的整段文案送去 AI 配音,同时生成字幕。画面这边,它从素材文件夹里按你设的片段长度(默认 2 到 4 秒)随机抽小段拼起来,所以每条视频的画面组合天然不一样,不用你手动打乱。
视频长度不用你算:整条视频多长由配音决定,文案念完多久视频就多长,末尾大约再加 0.5 秒。地区名会同时出现在三个地方——画面上的大标题、配音念出来的话、以及输出的文件名。文件名规则默认是 {文本2}_{序号},也就是说 20 个文件导出来自己就叫「余杭区_1.mp4」「西湖区_2.mp4」,不用再一个个改名分发。
也说清楚它不干什么。它不判断素材内容好不好看、不做智能选段,只是按你给的时长随机抽取拼接,素材质量还是得你自己把关;字幕是按句子长度分配显示时间的,不是逐字时间戳,出片后建议抽两条看一眼节奏;素材只扫描你选中文件夹的当前这一层,塞在子文件夹里的视频它不会自己去找。这三点心里有数,出片就不会翻车。
参数与操作补充
一行一条视频
名单可以导入 TXT / CSV / TSV,也可以直接从 Excel 复制粘贴。任意列数,空列会保留编号不显示。一批最多 500 行,每列最多 200 字。
画面随机拼接不重样
从所选文件夹当前层的 mp4 / mov / mkv / avi 里随机抽片段拼成画面,片段长度默认 2~4 秒,界面最小 1 秒、最高 30 秒。同一批出来的视频画面组合各不相同。
文案引用名单变量
文案里用 {{文本1}}、{{文本2}} 引用当前行的内容,跑到哪行换哪行的字。文案写多段的话每条随机抽一段,说法自己就散开了;替换后的文案同时用于配音和字幕。
文字、水印、字幕分层调
每一层各选各的样式预设,字体、字号、位置、颜色、描边、透明度都能改并实时预览。每列文字还能设「出现」和「持续」,精度 0.1 秒,留空就一直显示到片尾。
挑选音色并试听
在音色框里搜关键词,挑中先试听再用。系统随包的音色样本试听不扣积分;克隆音色第一次试听是现生成的,按中台规则计费并缓存。默认音色是 male-qn-qingse。
并发跑批与文件名变量
1~8 路并发,默认 2,电脑卡就降到 1。文件名默认 {文本2}_{序号},最多 120 字,支持 {文本N}、{序号}、{随机数字}、{随机字符}、{日期}、{时间},随机项默认 6 位可写成 {随机数字:8}。