先检查原始录音
普通单声道或立体声 MP3 都可以。码率过低、降噪过重可能已经损失部分人声细节。
MP3 转文字
选择录音笔、播客、会议或手机里的 MP3,EarScribe 会在浏览器中解码,自动识别语言,并生成可以和原音逐段核对的文字。
导出前先核对文字和时间戳
普通单声道或立体声 MP3 都可以。码率过低、降噪过重可能已经损失部分人声细节。
首次使用需要下载语音模型,之后同一浏览器可以复用缓存模型。
搜索人名、日期、价格和专业词,点击时间戳回听原音,确认后再导出。

把已经压缩过的 MP3 转成 WAV,并不能找回丢失的人声细节。
如果录音里有很长的静音,先裁掉可以减少内存占用。
完成文字和字幕核对前,建议保留原始 MP3。
可以。选中的 MP3 会在浏览器中解码和识别,不会发送到 EarScribe 服务器。
只有在更好地保留人声时才有帮助。麦克风距离、噪音和多人同时说话通常影响更大。
可以。核对带时间戳的结果后,可以直接导出 SRT 或 VTT。