EarScribe

音频转文字工具

免费把音频转成带时间戳的文字

选择 MP3、WAV、M4A、FLAC、OGG 或 WebM 录音,EarScribe 会自动识别语言,生成带时间戳的文字。你可以搜索、修改、点击回听,再导出需要的格式;音频无需上传。

  • 免费无限使用,无需注册,也没有按分钟额度
  • 点击任意时间戳,直接回听对应录音
  • 复制文字,或导出 TXT、SRT、VTT 和 JSON
拖入音频文件,或点击浏览
MP3、WAV、M4A、OGG、FLAC、WebM;可处理长度取决于设备内存

导出前先核对文字和时间戳

从录音到可用文字

1

选择录音

支持常见音频格式。手机或内存较小的电脑建议先处理较短文件,并使用均衡模式。

2

使用推荐精度

大多数录音直接使用均衡模式即可;需要更快或更高精度时,再展开高级选项。

3

核对并导出

搜索内容,修改人名和专业词,点击时间戳回听存疑片段,然后导出到剪辑、笔记或字幕工具。

EarScribe 带波形、搜索、编辑和导出功能的时间戳文字工作台

怎样让识别结果更准确

  • 人声清楚、背景噪音较少,通常比一味选择最大模型更重要。

  • 采访录音尽量让说话人靠近麦克风,避免音乐盖住人声。

  • 发布前重点核对人名、数字、品牌名和专业术语。

常见问题

支持哪些音频格式转文字?

支持浏览器可以解码的常见格式,包括 MP3、WAV、M4A、OGG、FLAC 和 WebM。

需要提前选择录音语言吗?

不需要。Whisper 会自动识别语言,完成后可以在结果工作台查看识别结果。

识别出来的文字可以修改吗?

可以。你可以逐段编辑、搜索全文、回听对应录音,并导出修改后的版本。

相关音频工具