语音转文字:本机识别并导出 TXT 与 SRT

录音要整理成稿子或字幕时,可以在浏览器里识别。声音不会发到外部语音服务,模型第一次使用时才从本站下载。

最近更新:2026年10月7日

需要马上处理?使用 语音转文字 ,浏览器本地完成,不上传服务器。

打开语音转文字

中文用 base

base 更适合中文,体积也更大。tiny 更快,适合先听一小段是否可用。

超过 15 分钟的录音请先用「音频裁剪」截短,否则浏览器容易内存不足。

字幕可以接着改

识别结果同时给出 TXT 和 SRT。时间轴要整体挪动、或要和另一份字幕合并时,打开「SRT 字幕工具箱」。

模型下载进度只在点击开始之后出现,并缓存在本机。

操作步骤

  1. 选择音频
  2. 中文保持 base
  3. 开始识别后下载 TXT 或 SRT

常见问题

音频会上传吗?

不会。识别在浏览器本地完成。

为什么不用网页自带的语音识别?

那种接口通常会把音频发到外部服务器,和本站不上传的做法冲突。