语音转文字:本机识别并导出 TXT 与 SRT
录音要整理成稿子或字幕时,可以在浏览器里识别。声音不会发到外部语音服务,模型第一次使用时才从本站下载。
最近更新:2026年10月7日
需要马上处理?使用 语音转文字 ,浏览器本地完成,不上传服务器。
打开语音转文字中文用 base
base 更适合中文,体积也更大。tiny 更快,适合先听一小段是否可用。
超过 15 分钟的录音请先用「音频裁剪」截短,否则浏览器容易内存不足。
字幕可以接着改
识别结果同时给出 TXT 和 SRT。时间轴要整体挪动、或要和另一份字幕合并时,打开「SRT 字幕工具箱」。
模型下载进度只在点击开始之后出现,并缓存在本机。
操作步骤
- 选择音频
- 中文保持 base
- 开始识别后下载 TXT 或 SRT
常见问题
音频会上传吗?
不会。识别在浏览器本地完成。
为什么不用网页自带的语音识别?
那种接口通常会把音频发到外部服务器,和本站不上传的做法冲突。