EarScribe
100% 免费,无需注册

免费无限音频转文字,生成带时间戳的文字和字幕。

免费、无限使用,无需注册或登录。将 MP3、WAV、M4A 等音频转成带时间戳的文字,自动识别语言;可复制文本或导出 SRT、VTT、TXT 字幕文件。音频不上传。

  • 免费,无限使用
  • 带时间戳文字稿
  • 导出 SRT & VTT
  • 无需注册,无需登录
拖入音频文件,或点击浏览
MP3、WAV、M4A、OGG、FLAC、WebM;可处理长度取决于设备内存

音频转文字——效果预览

真实转录文本,带时间戳、波形,一键导出字幕。

免费音频转文字——拖入播客、讲座或访谈,EarScribe 显示与音频同步的完整转录文本。点击任意行即可跳转,或一键导出为 SRT / VTT / TXT。

interview-acme-q3.mp324.3 MB · Whisper tiny
1:1412:48

转录文本

英语(自动检测) · 1,842 个词

  1. 00:00:08

    欢迎回来——今天我们与一位研究注意力的学者对话。

  2. 00:00:24

    打断其实并不像人们想象的那样是个问题。

免费无限制音频转文字的工作原理

三步开始,无需注册、无需登录,免费且无限使用。

免费、无限使用,无需注册。先用推荐设置生成文字稿,再核对内容并导出下一步需要的格式。

01

拖入音频

支持 MP3、WAV、M4A、OGG、FLAC 和 WebM。可处理的实际时长取决于浏览器和设备可用内存。

02

选择 Whisper 模型

大多数录音直接使用推荐的均衡设置;需要更小下载或更高精度时,再展开高级模型。

03

查看、编辑、导出

核对并编辑带时间戳的文字稿,检查字幕可读性,再导出 SRT、VTT、TXT 或 JSON。

你能做什么——100% 免费,无需注册,无限使用

免费无限制音频转文字——无需注册,无需登录。

EarScribe 是免费、无需注册无限使用音频转文字工具。支持MP3 转文字WAV 转文字M4A 转文字SRT 或 VTT 字幕。自动识别语言后,可搜索、编辑文字稿,点击时间戳回听,并导出 TXT、SRT、VTT 或 JSON。

从录音到可交付结果

不只是转写,而是一套简洁的文字稿工作台。

从文字定位原音

搜索文字稿,点击任意时间戳即可回听录音中的对应片段。

不用猜该选哪个模型

默认使用均衡推荐;只有需要更小下载或更高精度时,再展开高级模型。

99 种语言,自动识别

采访、课程和播客可自动识别音频语言,无需先手动选择。

导出前直接编辑

在工作台中修正人名、引语、数字和术语,复制与导出都会使用最新内容。

导出前检查字幕

集中检查空白、过长、阅读过快、重复和时间重叠的字幕,并优化断行。

把结果交给下一步

复制文字,或导出 TXT、SRT、VTT、JSON。免费、无限使用,无需注册。

免费无限制、无需登录的音频转文字——适合所有人

EarScribe 的常见使用场景。

把采访、课程、会议和视频音频整理为可搜索、可回听、可编辑、可导出的文字与字幕。

播客主与内容创作者播客

播客主与内容创作者

将播客音频转成文字,在转录内容中查找片段,再整理节目简介、标题和章节说明。

记者与研究人员新闻

记者与研究人员

把采访录音转成带时间戳的文字,便于检索引述、回听原声、核对内容和整理研究笔记。

学生与课堂录音教育

学生与课堂录音

将课堂录音或网课音频转成可搜索的文字,复习时可按关键词快速定位讲解内容。

会议与用户访谈研究

会议与用户访谈

将会议录音和用户访谈转成文字,方便提炼结论、标注待办事项并与团队共享整理后的内容。

视频字幕制作字幕

视频字幕制作

为短视频或长视频生成 .srt、.vtt 字幕,可导入 Premiere、Resolve、Final Cut 或 YouTube,并按剪辑节奏调整。

有声书与长音频长音频

有声书与长音频

长篇 MP3、有声书或播客录音也可转文字;选择适合设备性能的模型后即可开始处理,无需登录。

音频转文字——示例输出

同一段音频转文字,三种格式,随时可用。

MP3 转文字或音频转 SRT 文件的实际效果——直接粘贴到编辑器或上传至 YouTube。

transcript.srt
SubRip
1
00:00:08,120 --> 00:00:18,640
欢迎回来——我们正在讨论注意力研究。
transcript.vtt
WebVTT
WEBVTT

00:00:08.120 --> 00:00:18.640
欢迎回来——我们正在讨论注意力研究。
transcript.txt
纯文本
[00:00:08] 主持人:欢迎回来——我们正在讨论注意力研究。

按任务选择合适的工作方式

音频转文字的三种常见方式。

对比浏览器工作台、转录 API 和托管转录软件分别适合什么任务。

功能
EarScribe
转录 API托管软件
无需账号即可开始
无需 API 集成即可使用
包含可编辑的文字稿工作台
在哪里工作浏览器内你的产品内托管应用内
包含带时间戳的文字
点击时间戳回听原音
可选择模型因产品而异
内置五类字幕检查
免费无限使用
最适合处理、核对并导出单个录音集成到产品团队协作

EarScribe 免费音频转文字的数据

99

种语言

自动检测,无需手动选择。

4

种导出格式

文字稿完成后可导出 TXT、SRT、VTT 或 JSON。

$0

/ 月

100% 免费且无限使用——无需注册、无需登录、没有使用上限。

1

个结果工作台

搜索、回听、编辑和字幕检查集中在同一处。

音频转文字——支持的格式

免费、无限使用的音频转文字,无需注册或账号。支持 MP3 转文字、WAV 转文字、M4A 转文字及更多常见音频格式。

MP3WAVM4AOGGFLACWebMOpusAAC

支持 99 种语言的免费音频转文字(自动检测)

Whisper 支持 99 种语言的音频转文字,模型会自动识别音频语言,无需手动选择。

英语普通话西班牙语印地语阿拉伯语葡萄牙语孟加拉语俄语日语旁遮普语德语爪哇语韩语法语泰卢固语越南语泰米尔语意大利语土耳其语波兰语乌克兰语荷兰语波斯语泰语瑞典语捷克语希腊语希伯来语芬兰语挪威语匈牙利语+68 种

一份转写内容,衔接三种工作流

先拿到文字,再打开下一步需要的工具。

大多数时候,读懂文字并导出即可。需要做字幕、整理采访或复习课程时,再使用搜索、编辑和字幕检查,不打扰第一步。

字幕制作流程

适用于视频和短视频

导出 SRT 或 VTT 前,检查字幕的文字长度、阅读速度、重复内容和时间重叠。

采访整理流程

适用于调研和报道

搜索转写内容,点击时间戳回听原始录音,再直接修改人名、术语或引述。

学习复习流程

适用于课堂录音和网课

快速搜索课程主题,整理转写文字后导出 TXT,用于笔记、引用或复习。

100% 免费,无需注册,无限使用

拖入音频文件,免费开始音频转文字——无需注册,无需登录,无限使用。

回到顶部选择文件,使用推荐设置生成带时间戳的文字稿,再核对内容并导出 SRT、VTT、TXT 或 JSON。

免费无限制音频转文字——常见问题

EarScribe 真的 100% 免费且没有限制吗?

是的。EarScribe 免费、无限使用,无需注册或登录;不设付费套餐、不需要信用卡,也不按分钟收费。Whisper 语音转文字模型在你的设备上运行,因此不产生云端转录费用。

导出前可以修改文字稿吗?

可以。开启编辑后可修正人名、引语、数字和专业术语;复制文字和所有导出格式都会使用修改后的内容,草稿会保存在当前浏览器中。

字幕检查会发现哪些问题?

它会标出空白、过长、阅读过快、重复和时间重叠的字幕。你可以一键优化断行,再回听重点片段后导出 SRT 或 VTT。

为什么第一次运行比较慢?

首次选择模型时,浏览器需要下载模型文件(根据大小不同,约 80 MB 至 800 MB)。之后模型会被缓存并复用,无需再次下载。

支持哪些语言?

通过 Whisper 支持 99 种语言的音频转文字。语言会自动检测,无需手动选择。

可以转录视频吗?

暂不支持直接转录视频。如需将视频音频转文字,请先提取音频(任何能导出 MP3 或 WAV 的工具均可),然后将音频文件拖入这里。

应该选择哪个 Whisper 模型?

大多数录音先用推荐的均衡模型。希望下载更小可选 Tiny;较难识别的音频可在设备内存足够时尝试 Small;性能较好的设备可使用 Turbo 追求更高精度。

如何免费将 MP3 转换为文字?

选择 MP3,保留推荐的均衡设置,完成后核对带时间戳的文字稿。修正关键信息,再复制文字或导出 SRT、VTT、TXT、JSON;无需账号。

有没有免费的 Otter.ai 或 Rev 替代品?

如果你只想免费处理一段录音,不想先注册账号,EarScribe 提供转写、搜索、按时间戳回听、编辑、字幕检查和导出的一体化流程。需要团队协作空间时,托管服务可能更合适。

能从音频生成 SRT 或 VTT 字幕吗?

可以。音频转文字完成后,点击「导出」选择 .srt 或 .vtt。字幕时间轴使用 Whisper 输出的时间戳,必要时可再按你的剪辑需求微调。

这个工具在浏览器中运行 OpenAI Whisper 吗?

是的——EarScribe 通过 Transformers.js 在浏览器中运行 Whisper(Tiny、Base、Small 和 Large v3 Turbo),优先使用 WebGPU,不可用时自动回退至 WebAssembly。