全部功能/字幕提取
老黄牛桌面工具
免费字幕提取工具:视频音频转 SRT 与 TXT
批量识别视频或音频原声,导出本地字幕文件
字幕提取适合把访谈、口播、课程和会议录音中的声音整理为字幕时间轴或纯文字。它读取媒体中的音轨,不会识别画面上已经压制的硬字幕,也不提供 OCR。可批量导入视频、音频或递归扫描文件夹,每个素材分别输出 SRT、TXT 或两种格式。首次使用需要下载约 57 MiB 的本地识别模型,之后识别在本机完成,素材不会上传;结果可能出现同音字、专有名词和时间点误差,使用前应人工校对。已随老黄牛AI v0.3.21 提供,在功能中心“免费工具”区域打开。
能做什么
核心功能
视频和音频批量导入
可选择或拖入多个视频、音频及文件夹,递归扫描符合类型的文件,单次最多加入 200 个。
SRT 与 TXT 输出
SRT 保留字幕时间轴,TXT 只保留识别文字,也可一次同时生成两种格式。输出不覆盖原素材或已有文件,同名时自动追加编号,如 (2)、(3)。
五种语言选项
支持自动检测以及中文、英语、日语、韩语;已知素材语言时可直接指定。
本地模型与共享缓存
首次主动下载约 57 MiB 的模型,可取消和继续;已有视频处理或 AI 剪辑模型缓存时直接共用。识别在本机完成,素材不上传。
按需选择
当前套餐
该功能当前为免费使用。
系统要求与安装说明
- Windows:v0.3.21;Windows 10 1903+ / 11 x64
- macOS:v0.3.21;macOS 14+、Apple 芯片
- 免费、本地处理,不需要登录,不扣积分,也没有套餐。
- 首次使用需要联网下载约 57 MiB 的本地识别模型;之后可复用缓存,模型下载速度取决于当前网络。
- 支持 MP4、MOV、MKV、AVI、WEBM、M4V 视频,以及 MP3、WAV、M4A、AAC、FLAC、OGG、OPUS 音频;输入必须包含可读取的音轨。
- 输出不会覆盖原素材或已有文件;同一保存目录遇到同名结果时自动追加编号,如 (2)、(3)。
- 只识别声音,不读取画面中的硬字幕,不支持 OCR。
- 口音、噪声、多人重叠、背景音乐和专有名词会影响准确率,结果需要人工校对。
- 运行范围为 macOS 14 或更新版本(Apple 芯片),以及 Windows 10 1903(build 18362)或更新的 64 位系统。
- 需要安装老黄牛AI v0.3.21 或更新版本;更早版本不包含此入口。
更新记录
版本 0.3.21
- 新增免费字幕提取:批量识别视频或音频原声,在本机导出 SRT、TXT 字幕;支持文件夹递归与中/英/日/韩自动检测,不登录、不扣积分。
- 输出同名文件自动追加编号 (2)/(3),不覆盖已有文件;单批最多 200 个文件。