EarScribe

音频转 SRT 字幕工具

把音频转换成 SRT 字幕

从 MP3、WAV、M4A 等音频生成 SRT 或 VTT。EarScribe 会保留 Whisper 时间戳,标出常见的可读性问题,并在导出前帮助你优化断行。

  • 检查过长、过快、重复、空白和时间重叠字幕
  • 点击字幕即可回听原音,再决定是否修改
  • 同一结果可导出 SRT、VTT、TXT 和 JSON
拖入音频文件,或点击浏览
MP3、WAV、M4A、OGG、FLAC、WebM;可处理长度取决于设备内存

导出前先核对文字和时间戳

从音频到可发布字幕

1

生成带时间轴的字幕

识别音频,并保留模型为每个片段生成的时间范围。

2

运行字幕体检

集中检查过长、阅读过快、重复、空白或时间重叠的字幕。

3

完整预览后导出

优化断行,回听重点片段,再导出 SRT 或 VTT 到剪辑软件和视频平台。

EarScribe 字幕体检界面,显示时间戳字幕和 SRT 导出

字幕可读性的基本原则

  • 两行短字幕通常比一整行长句更容易阅读。

  • 语速很快时,可能需要精简文字或更合理地拆分时间段。

  • 人名、数字和画面里的专有词,发布前应人工核对。

常见问题

SRT 和 VTT 有什么区别?

两者都保存带时间轴的字幕。SRT 被多数剪辑软件和平台支持;VTT 更适合网页视频,并支持更多 Web 字幕能力。

EarScribe 能自动修好所有字幕吗?

它可以优化断行并标出常见问题,但重要视频仍应完整预览,人工确认措辞和时间。

下载前可以修改字幕文字吗?

可以。先编辑带时间戳的文字,再回到字幕体检,导出更新后的 SRT 或 VTT。

相关音频工具