老黄牛AI
功能价格教程博客下载
登录 / 控制台
功能价格教程博客下载

全部教程/字幕提取

使用指南

字幕提取教程:视频音频转 SRT 与 TXT

准备带有清晰原声的视频或音频和一个可写的保存目录。首次使用需要先下载本地识别模型。

约 3 分钟阅读 · 6 个步骤 · 产出 保存目录中的 SRT、TXT 字幕文件

操作步骤

  1. 准备本地模型
  2. 添加视频或音频
  3. 选择语言和格式
  4. 选择保存目录
  5. 开始并检查进度
  6. 打开并校对结果

步骤 01

准备本地模型

进入“字幕提取”后查看“本地识别模型”。首次使用点“下载模型”;下载可取消、继续,已有缓存会自动共用。

步骤 02

添加视频或音频

拖入文件、文件夹,或点“选择文件 / 选择文件夹”。文件夹可递归扫描;页面会说明不支持类型、重复项、空文件夹和 200 个上限。

步骤 03

选择语言和格式

语言可选自动检测、中文、英语、日语或韩语;输出可选 SRT、TXT 或两种。SRT 含时间轴,TXT 只保留文字。

步骤 04

选择保存目录

在“保存到”选择已有且可写的目录。输出按每个输入素材分别新建文件,不覆盖原素材或已有结果;同名时自动追加编号,如 (2)、(3)。

步骤 05

开始并检查进度

点“开始提取字幕”,逐项查看等待、识别、完成或失败状态。需要停止时点“取消任务”,已完成结果会保留。

步骤 06

打开并校对结果

在完成项旁打开 SRT 或 TXT,重点检查同音字、专有名词、断句和字幕时间点,再用于剪辑或发布。

实用技巧

  • 素材语言明确时直接指定语言,通常比自动检测更稳定。
  • 先用一小段代表性素材检查准确率,再加入长音频或大批量文件。
  • 噪声大、多人同时说话或背景音乐明显时,先改善音轨质量再识别。

常见问题

能提取画面里的硬字幕吗?

不能。本工具只识别视频或音频中的声音,不做 OCR;没有音轨的素材无法还原画面文字。

支持哪些输入?

视频支持 MP4、MOV、MKV、AVI、WEBM、M4V;音频支持 MP3、WAV、M4A、AAC、FLAC、OGG、OPUS。也可导入文件夹并递归扫描,单次最多加入 200 个符合类型的文件。

为什么首次使用要下载模型?

语音识别在本机运行,需要约 57 MiB 的模型。下载可取消、继续;已有视频处理或 AI 剪辑缓存时会直接共用。

下载模型后还需要联网吗?

模型已完整缓存后,本地识别不上传素材。重新下载、更新模型或缓存缺失时仍需要网络。

SRT 和 TXT 有什么区别?

SRT 包含字幕序号和时间轴,适合导入剪辑软件;TXT 只保存识别文字,适合阅读和整理。

为什么识别不准确?

口音、噪声、多人重叠、背景音乐、专有名词和音量过低都会影响结果。请校对文字和时间点,必要时先处理音频。

取消后结果会丢失吗?

任务会停止,未完成临时文件会清理;已经成功生成的 SRT 或 TXT 会保留在保存目录。

同名字幕会覆盖吗?

不会。保存目录已有同名 SRT 或 TXT 时,新结果会自动追加编号,如 (2)、(3)。

支持哪些系统?

macOS 14 或更新版本(Apple 芯片),以及 Windows 10 1903(build 18362)或更新的 64 位系统。

需要登录、套餐或积分吗?

不需要。该工具免费、本地处理,不登录,也不会扣积分。

遇到问题如何反馈?

请记录系统版本、素材类型、操作步骤和完整报错,发邮件至 support@laohuangniu.net;请勿发送账号密码或私密素材。

查看功能详情与下载 →

返回全部教程 →

老黄牛AI

内容创作者的批量干活工具。把重复的图文和视频工作,交给电脑。

软件

  • 全部功能
  • 下载客户端
  • 价格与开通

使用帮助

  • 使用教程
  • 常见问题
  • 博客
  • 进入控制台

关于

  • 关于我们
  • 联系我们
  • 隐私政策
  • 服务条款
  • 使用须知与免责声明
  • Cookie 与本地存储
© 2026 老黄牛AI · laohuangniu.net
浙ICP备16029135号-20