EarScribe

MP3 转文字

免费把 MP3 转成文字

选择录音笔、播客、会议或手机里的 MP3,EarScribe 会在浏览器中解码,自动识别语言,并生成可以和原音逐段核对的文字。

  • 无需上传排队,也不用注册账号
  • 在设备承受范围内处理长录音
  • 保留时间戳,方便回听和导出字幕
拖入音频文件,或点击浏览
MP3、WAV、M4A、OGG、FLAC、WebM;可处理长度取决于设备内存

导出前先核对文字和时间戳

免费、实用的 MP3 转文字流程

1

先检查原始录音

普通单声道或立体声 MP3 都可以。码率过低、降噪过重可能已经损失部分人声细节。

2

在浏览器中识别

首次使用需要下载语音模型,之后同一浏览器可以复用缓存模型。

3

重点核对关键信息

搜索人名、日期、价格和专业词,点击时间戳回听原音,确认后再导出。

EarScribe 将 MP3 转成可编辑的带时间戳文字

MP3转文字

MP3 可以直接转文字,也要保留核对路径

手里的文件已经是 MP3,就不该为了识别再转一次格式。直接选择 MP3,生成带时间戳文字,核对后再导出文字稿或字幕。

MP3 不需要先转成 WAV

录音笔、播客、会议或手机里的 MP3 都可以直接选择。浏览器会在本地解码,模型会自动识别录音语言。

把已经压缩过的 MP3 转成 WAV,不能找回压缩时丢掉的细节。如果文件里有很长的静音,先裁剪往往比改容器更能减少内存压力。

先找到容易错的部分

搜索人名、日期、价格和专业词,再点击时间戳回听。与其重新听完整录音,不如先定位最需要人工判断的片段。

高码率只有在保留更清楚的人声时才有帮助。麦克风距离、背景噪音和多人同时说话,通常影响更大。

同一个 MP3,导出文字或字幕

TXT 适合阅读和整理,SRT 或 VTT 适合剪辑和网页视频。核对后的分段会在不同格式中保留时间轴。

文字和字幕确认前不要覆盖原始 MP3。之后遇到疑似错词时,原文件就是最快的证据。

MP3 转文字工作台,显示时间戳、波形、搜索和导出
MP3 转文字工作台,显示时间戳、波形、搜索和导出

导出前先核对文字和时间戳

MP3 准备与核对清单

  1. 1

    保留原件

    处理前复制一份,不要覆盖原始录音。

  2. 2

    检查静音

    特别长的空白段可以先裁掉。

  3. 3

    回听专名

    用时间戳核对人名、数字和不常见词。

  4. 4

    选对输出

    阅读用 TXT,字幕用 SRT 或 VTT。

MP3 转文字的实际边界

  • 免费无限使用不等于每台设备都能处理数小时录音,浏览器内存会决定实际可处理长度。
  • 转成 WAV 不会修复削波、音乐盖住人声、距离过远或过度降噪造成的信息损失。

MP3 文件需要注意什么

  • 把已经压缩过的 MP3 转成 WAV,并不能找回丢失的人声细节。

  • 如果录音里有很长的静音,先裁掉可以减少内存占用。

  • 完成文字和字幕核对前,建议保留原始 MP3。

常见问题

MP3 不上传也能转文字吗?

可以。选中的 MP3 会在浏览器中解码和识别,不会发送到 EarScribe 服务器。

MP3 码率越高,识别就越准吗?

只有在更好地保留人声时才有帮助。麦克风距离、噪音和多人同时说话通常影响更大。

同一个 MP3 可以生成字幕吗?

可以。核对带时间戳的结果后,可以直接导出 SRT 或 VTT。

相关音频工具