步骤 01
选择配音或转写
从左侧进入“文字配音”或“音视频转文字”。本地转写无需登录;云服务和我的音色需要登录。
步骤 01
从左侧进入“文字配音”或“音视频转文字”。本地转写无需登录;云服务和我的音色需要登录。
步骤 02
配音页在“输入方式”选“直接输入”逐行粘贴文案,或选“导入 TXT”后点“选择 TXT 文件”多选、拖入 TXT 文件或文件夹,再选“每个 TXT 生成一个音频”或“每行生成一个音频”;转写页可点击选择或从系统文件管理器拖入音频、视频或文件夹,文件夹可包含子文件夹。
扫描后核对找到的文件数、重复项、不支持类型和读取错误。
步骤 03
配音选择软件内开放的服务(MiniMax、微软 Azure、豆包)、音色、语速及 MP3 / WAV;转写在“识别方式”中选“本地识别(免费,默认)”、“豆包云识别”、“阿里云识别”,识别语言默认中文,中文结果统一转为简体。未开放的服务会保持禁用。
步骤 04
本地识别不收费。云配音、云识别、声音克隆必须显示服务端报价后再明确提交;TXT 批量点“生成全部”后,在确认框核对音频数、段数、预计积分和可用积分。按积分计费,以实际扣费提示为准。
试听、打开页面和恢复原任务不会自动创建收费请求。
步骤 05
到任务区域查看排队、处理、完成、失败或取消状态。网络异常先恢复原请求,不要重复提交。TXT 批量可点“停止”(当前这一段完成后停下)、“重试失败项”或“恢复查询”,恢复查询不会新建收费任务。
步骤 06
试听并保存已生成音频;TXT 批量选好输出文件夹后点“全部保存到文件夹”,重名自动加“ (1)”,不覆盖已有文件。识别结果可预览、复制、导出 TXT / SRT,也可选好文件夹一键全部导出(文件名同原视频,重名自动加序号,不覆盖)。需要修改文字请导出后在编辑器中修改。原始媒体不会被改写。
不收费,也不需要月卡。首次下载模型需要联网,识别在本机执行。
只有登录、服务端完成配置并返回真实报价时才开放;当前不可用会明确禁用,不会用模拟结果代替。
目前开放 MiniMax、微软 Azure、豆包,音色按语种和男女声分类;豆包另有粤语、上海话、河南话、北京话、天津话、四川话、陕西话、东北话 8 种方言音色。实际可选项以软件内音色列表为准。
单条字数上限随服务不同,超限时不会扣积分。把文案拆成多行,或改用“导入 TXT”批量配音,超过 1000 字会自动分段合成并在保存时拼成一个完整音频。
识别语言选“中文”(默认)时,本地识别结果会自动统一转为简体;选“自动判断”时不做转换,可改选“中文”后重新识别。
按积分计费,以提交前的报价为准,配音生成另计。创建前需确认是本人声音或已获授权;目前提供 MiniMax 克隆,克隆音色各模块共用。
两种都可以,导入后自己选:每个 TXT 生成一个音频(文件名同 TXT),或每行生成一个音频(文件名为“原名-行号”)。超过 1000 字会自动分段合成、保存时拼成一个完整音频;每段按服务端报价单独计费,生成前会显示预计积分并需要确认,已生成的段不会重复扣费。
可以。点击选择文件夹或直接拖入,一次最多 500 个文件;扫描会说明不支持类型、重复文件、空文件夹、数量限制与读取失败。
软件内只提供预览、复制和导出 TXT / SRT,可一键全部导出到文件夹;需要修改文字请导出后在编辑器中修改。
本地识别不扣积分;云任务先恢复原请求并查看服务端回执。未知结果不会自动用新请求重试。
可以。删除前会列出会删和不会删的内容,只删软件内记录和软件保存的副本,原音视频、原文案和已导出的文件不动。运行中的本地任务先取消;结果未确认的云任务暂不能删除。删除不退回积分,也不会重复扣费;克隆音色删除后需要重新付费克隆。
在下载页安装老黄牛AI 桌面客户端(v0.3.30 或更新版本),登录后在功能中心打开「文字与音频」;只用本机识别也可以不登录。