全部功能/文字与音频
老黄牛桌面工具
文字与音频:文案配音与音视频转文字
文字批量配音、音视频转文字,管理账号克隆音色
文字与音频适合批量制作文案配音、整理采访录音和从视频提取字幕。配音可逐行输入或批量导入 TXT,超过 1000 字自动分段合成、在本机拼成完整音频;识别默认在本机运行,免费、素材不上传,结果可预览、复制并导出 TXT / SRT。云配音、云识别、声音克隆按提交前的实时报价扣积分,可选的服务与音色以软件内实际开放为准。
- 价格
- 无需开通,按使用扣积分,提交前显示实时报价
- 支持系统
- Windows 10 1903+ / 11 x64 · macOS 14+、Apple 芯片
- 当前版本
- v0.3.32 · Windows 225.0 MiB · macOS 228.9 MiB
能做什么
核心功能
直接输入配音
在文本框逐行粘贴文案,每行生成一条配音(一次最多 100 行);选好音色、语速和 MP3 / WAV,核对报价后生成,可试听、逐条保存。
TXT 批量导入配音
多选或拖入 TXT 文件和文件夹,可选每个 TXT 或每一行生成一个音频;超过 1000 字自动分段合成,一键保存到文件夹,重名不覆盖。
本地免费转写
导入音频、视频或文件夹,首次下载模型后在本机批量识别,不上传素材、不扣积分;识别语言选中文时结果统一转为简体。
云服务
云配音可选 MiniMax、微软 Azure、豆包(豆包另有粤语、上海话、四川话等方言音色);云识别可选 豆包、阿里云 Fun-ASR。未开放的服务在软件里明确禁用。
预览与导出
每个文件显示识别预览,可展开全文、复制,或导出 TXT / SRT,也可一键全部导出;需要改文字请导出后在编辑器里改。
账号共享音色
声音克隆使用 MiniMax,克隆音色归当前账号,可在所有接入公共配音的老黄牛模块里使用。
持久任务与恢复
配音、识别和克隆任务保留进度与错误;网络异常先恢复原请求,避免重复扣费。
系统要求与安装说明
- Windows:v0.3.32;Windows 10 1903+ / 11 x64
- macOS:v0.3.32;macOS 14+、Apple 芯片
- 无需开通月卡:本机识别免费;云配音、云识别、声音克隆按积分计费,提交前显示实时报价,积分可在定价页购买。
- 需要老黄牛AI 桌面客户端(Windows / macOS),随 v0.3.30 起提供;本机识别首次需联网下载模型,云服务需要微信扫码登录。
- 单条配音字数上限随服务不同,超限不扣积分;TXT 批量每批最多 100 个 TXT(单个 2MB 以内),单个音频最多 30000 字,超过 1000 字自动分段。
- 一次最多扫描 500 个文件;云识别单个文件不超过 2 小时、250MB;请确保导出位置有足够空间。
- 声音克隆只上传本人声音或已取得明确授权的录音(10 秒至 5 分钟、20MB 以内的 MP3 / WAV / M4A),克隆费用以提交前报价为准,配音另计。
- 机器识别和合成结果需试听或校对,不承诺零错字、完全还原情绪或适合所有声音。
更新记录
版本 0.3.32
- Windows、macOS v0.3.32 已提供。
- 无序组合:文案模板下方可一键「插入变量」,按关联文本的列插入 {{文本1}}、{{文本2}}…;勾选关联文本时可设「每行生成几份」,同一行的几份画面与时长各自随机,配音按文案复用不重复扣费。
- AI 短剧混剪:云端识别默认推荐豆包,可区分说话人,识别后自动出现角色映射。
- 文字与音频:微软、豆包、MiniMax 三家的配音音色都能在选择器里直接试听(试听不扣积分)。
- 文字与音频:窗口标题与顶栏改用「文字与音频」并与其他功能一致;未登录时不再出现英文提示;TXT 批量默认选中第一个中文音色;重开窗口后恢复配音草稿。
- 充值积分弹窗注明「所有功能通用」;分享换试用弹窗改为微信二维码,并说明群要求。
- AI 剪辑帮助页跟上识别引擎可选;AI 剪辑的云端识别确认框不再误写「可区分说话人」。
版本 0.3.31
- Windows、macOS v0.3.31 已提供。
- 云端识别在音频已经传到云端后点取消,现在会明确提示「已取消,但音频已经传到云端,这次识别会照常扣费(服务商识别失败会自动退回)」;视频处理、无序组合、AI 剪辑都生效,音频还没传完时取消仍然不扣费。