生成带时间轴的字幕
识别音频,并保留模型为每个片段生成的时间范围。
音频转 SRT 字幕工具
从 MP3、WAV、M4A 等音频生成 SRT 或 VTT。EarScribe 会保留 Whisper 时间戳,标出常见的可读性问题,并在导出前帮助你优化断行。
导出前先核对文字和时间戳
识别音频,并保留模型为每个片段生成的时间范围。
集中检查过长、阅读过快、重复、空白或时间重叠的字幕。
优化断行,回听重点片段,再导出 SRT 或 VTT 到剪辑软件和视频平台。

两行短字幕通常比一整行长句更容易阅读。
语速很快时,可能需要精简文字或更合理地拆分时间段。
人名、数字和画面里的专有词,发布前应人工核对。
两者都保存带时间轴的字幕。SRT 被多数剪辑软件和平台支持;VTT 更适合网页视频,并支持更多 Web 字幕能力。
它可以优化断行并标出常见问题,但重要视频仍应完整预览,人工确认措辞和时间。
可以。先编辑带时间戳的文字,再回到字幕体检,导出更新后的 SRT 或 VTT。