播客播客主与内容创作者
将播客音频转成文字,在转录内容中查找片段,再整理节目简介、标题和章节说明。
免费、无限使用,无需注册或登录。将 MP3、WAV、M4A 等音频转成带时间戳的文字,自动识别语言;可复制文本或导出 SRT、VTT、TXT 字幕文件。音频不上传。
音频转文字——效果预览
免费音频转文字——拖入播客、讲座或访谈,EarScribe 显示与音频同步的完整转录文本。点击任意行即可跳转,或一键导出为 SRT / VTT / TXT。
英语(自动检测) · 1,842 个词
欢迎回来——今天我们与一位研究注意力的学者对话。
打断其实并不像人们想象的那样是个问题。
免费无限制音频转文字的工作原理
免费、无限使用,无需注册。先用推荐设置生成文字稿,再核对内容并导出下一步需要的格式。
支持 MP3、WAV、M4A、OGG、FLAC 和 WebM。可处理的实际时长取决于浏览器和设备可用内存。
大多数录音直接使用推荐的均衡设置;需要更小下载或更高精度时,再展开高级模型。
核对并编辑带时间戳的文字稿,检查字幕可读性,再导出 SRT、VTT、TXT 或 JSON。
你能做什么——100% 免费,无需注册,无限使用
EarScribe 是免费、无需注册且无限使用的音频转文字工具。支持MP3 转文字、WAV 转文字、M4A 转文字和SRT 或 VTT 字幕。自动识别语言后,可搜索、编辑文字稿,点击时间戳回听,并导出 TXT、SRT、VTT 或 JSON。
从录音到可交付结果
搜索文字稿,点击任意时间戳即可回听录音中的对应片段。
默认使用均衡推荐;只有需要更小下载或更高精度时,再展开高级模型。
采访、课程和播客可自动识别音频语言,无需先手动选择。
在工作台中修正人名、引语、数字和术语,复制与导出都会使用最新内容。
集中检查空白、过长、阅读过快、重复和时间重叠的字幕,并优化断行。
复制文字,或导出 TXT、SRT、VTT、JSON。免费、无限使用,无需注册。
免费无限制、无需登录的音频转文字——适合所有人
把采访、课程、会议和视频音频整理为可搜索、可回听、可编辑、可导出的文字与字幕。
播客将播客音频转成文字,在转录内容中查找片段,再整理节目简介、标题和章节说明。
新闻把采访录音转成带时间戳的文字,便于检索引述、回听原声、核对内容和整理研究笔记。
教育将课堂录音或网课音频转成可搜索的文字,复习时可按关键词快速定位讲解内容。
研究将会议录音和用户访谈转成文字,方便提炼结论、标注待办事项并与团队共享整理后的内容。
字幕为短视频或长视频生成 .srt、.vtt 字幕,可导入 Premiere、Resolve、Final Cut 或 YouTube,并按剪辑节奏调整。
长音频长篇 MP3、有声书或播客录音也可转文字;选择适合设备性能的模型后即可开始处理,无需登录。
音频转文字——示例输出
MP3 转文字或音频转 SRT 文件的实际效果——直接粘贴到编辑器或上传至 YouTube。
1 00:00:08,120 --> 00:00:18,640 欢迎回来——我们正在讨论注意力研究。
WEBVTT 00:00:08.120 --> 00:00:18.640 欢迎回来——我们正在讨论注意力研究。
[00:00:08] 主持人:欢迎回来——我们正在讨论注意力研究。
按任务选择合适的工作方式
对比浏览器工作台、转录 API 和托管转录软件分别适合什么任务。
| 功能 | EarScribe你 | 转录 API | 托管软件 |
|---|---|---|---|
| 无需账号即可开始 | 是 | 否 | 否 |
| 无需 API 集成即可使用 | 是 | 否 | 是 |
| 包含可编辑的文字稿工作台 | 是 | 否 | 是 |
| 在哪里工作 | 浏览器内 | 你的产品内 | 托管应用内 |
| 包含带时间戳的文字 | 是 | 是 | 是 |
| 点击时间戳回听原音 | 是 | 否 | 是 |
| 可选择模型 | 是 | 是 | 因产品而异 |
| 内置五类字幕检查 | 是 | 否 | 否 |
| 免费无限使用 | 是 | 否 | 否 |
| 最适合 | 处理、核对并导出单个录音 | 集成到产品 | 团队协作 |
99
种语言
自动检测,无需手动选择。
4
种导出格式
文字稿完成后可导出 TXT、SRT、VTT 或 JSON。
$0
/ 月
100% 免费且无限使用——无需注册、无需登录、没有使用上限。
1
个结果工作台
搜索、回听、编辑和字幕检查集中在同一处。
免费、无限使用的音频转文字,无需注册或账号。支持 MP3 转文字、WAV 转文字、M4A 转文字及更多常见音频格式。
Whisper 支持 99 种语言的音频转文字,模型会自动识别音频语言,无需手动选择。
一份转写内容,衔接三种工作流
大多数时候,读懂文字并导出即可。需要做字幕、整理采访或复习课程时,再使用搜索、编辑和字幕检查,不打扰第一步。
字幕制作流程
适用于视频和短视频
导出 SRT 或 VTT 前,检查字幕的文字长度、阅读速度、重复内容和时间重叠。
采访整理流程
适用于调研和报道
搜索转写内容,点击时间戳回听原始录音,再直接修改人名、术语或引述。
学习复习流程
适用于课堂录音和网课
快速搜索课程主题,整理转写文字后导出 TXT,用于笔记、引用或复习。
是的。EarScribe 免费、无限使用,无需注册或登录;不设付费套餐、不需要信用卡,也不按分钟收费。Whisper 语音转文字模型在你的设备上运行,因此不产生云端转录费用。
可以。开启编辑后可修正人名、引语、数字和专业术语;复制文字和所有导出格式都会使用修改后的内容,草稿会保存在当前浏览器中。
它会标出空白、过长、阅读过快、重复和时间重叠的字幕。你可以一键优化断行,再回听重点片段后导出 SRT 或 VTT。
首次选择模型时,浏览器需要下载模型文件(根据大小不同,约 80 MB 至 800 MB)。之后模型会被缓存并复用,无需再次下载。
通过 Whisper 支持 99 种语言的音频转文字。语言会自动检测,无需手动选择。
暂不支持直接转录视频。如需将视频音频转文字,请先提取音频(任何能导出 MP3 或 WAV 的工具均可),然后将音频文件拖入这里。
大多数录音先用推荐的均衡模型。希望下载更小可选 Tiny;较难识别的音频可在设备内存足够时尝试 Small;性能较好的设备可使用 Turbo 追求更高精度。
选择 MP3,保留推荐的均衡设置,完成后核对带时间戳的文字稿。修正关键信息,再复制文字或导出 SRT、VTT、TXT、JSON;无需账号。
如果你只想免费处理一段录音,不想先注册账号,EarScribe 提供转写、搜索、按时间戳回听、编辑、字幕检查和导出的一体化流程。需要团队协作空间时,托管服务可能更合适。
可以。音频转文字完成后,点击「导出」选择 .srt 或 .vtt。字幕时间轴使用 Whisper 输出的时间戳,必要时可再按你的剪辑需求微调。
是的——EarScribe 通过 Transformers.js 在浏览器中运行 Whisper(Tiny、Base、Small 和 Large v3 Turbo),优先使用 WebGPU,不可用时自动回退至 WebAssembly。