转写最终混音
使用导出的成品(MP3、WAV 或 M4A),时间戳才会和听众听到的一致。
播客转文字
放入剪辑软件导出的单集音频,EarScribe 会在你的设备上生成带时间戳的文字稿:可以搜索金句、整理节目笔记和章节,也可以导出成视频版的字幕。
导出前先核对文字和时间戳
使用导出的成品(MP3、WAV 或 M4A),时间戳才会和听众听到的一致。
搜索嘉宾名字、品牌和网址,逐处回听并改正写法。
复制文字写节目笔记,记下时间点做章节,再导出 SRT 或 VTT 给视频版使用。

播客转文字
文字稿真正派上用场是在节目上线之后:它可以变成节目笔记、章节标记、社交平台的金句和视频版字幕,时间戳把这些内容都连回原音频。
浏览文字稿找出话题转换的地方,记下时间点。很多平台会把简介里的时间点列表变成章节,比如 YouTube 要求列表从 0:00 开始,至少三个章节,每章不少于 10 秒。
用改正后的文字稿写笔记,而不是原始识别结果,这样嘉宾名字和链接都是你确认过的写法。
搜索你记得的那句话,点击时间戳听完整句再引用。上下文常常会影响一句话该怎么截取。
剪短视频切片时,时间戳能直接告诉剪辑师位置,不用在一小时的音频里来回拖动。
为视频版导出 SRT 或 WebVTT,并运行字幕检查,找出太长或读不过来的字幕条。
公开的文字稿也方便听障听众和喜欢快速浏览的人。按照播客命名空间规范,可以用 podcast:transcript 标签在 RSS 里链接文字稿文件。

导出前先核对文字和时间戳
嘉宾、公司、产品和地名写法正确。
网址和优惠码对照音频核实。
决定赞助口播是否保留在公开文字里。
章节时间和字幕与最终混音一致。
片头音乐和垫乐可能被识别出多余或重复的句子,记得检查开头和结尾几分钟。
EarScribe 不标注说话人。核对时借助时间戳找到每次换人,补上主播和嘉宾的名字。
长节目很占内存。在手机上可以分段转写,或者换更小的模型。
大多数电脑可以。特别长的节目取决于可用内存,浏览器吃力时请拆分单集或换更小的模型。
可以把改好的文字放到单集页面;也可以导出 SRT 或 WebVTT,通过 RSS 的 podcast:transcript 标签链接给播客 App,支持这个标签的 App 越来越多。
不能。Whisper 输出的是一条连续的文字时间线。可以借助时间戳找到换人的地方,在需要处补上名字。
不可以。EarScribe 处理的是你设备上的音频文件,请使用剪辑软件导出的文件,或先下载单集音频。