EarScribe

ローカル 文字起こし

無料のローカル文字起こし:音声をアップロードしない

EarScribeは、ブラウザのタブの中で録音をデコードして文字起こしします。ファイルがサーバーに送られることはなく、大きなダウンロードは音声モデルだけで、ブラウザがキャッシュします。このページでは、端末に残るもの、ページが送信するもの、そして自分で確かめる方法を説明します。

  • 録音は端末から出ない
  • インストールもアカウントも不要
  • ブラウザの開発者ツールで確認できる
音声ファイルをドロップ、またはクリックして選択
MP3、WAV、M4A、OGG、FLAC、WebM。処理できる長さは端末のメモリによります

書き出す前に文字とタイムスタンプを確認

無料のローカル文字起こしで起きること

1

ブラウザがファイルを読む

録音はディスクから開かれ、ブラウザ自身のオーディオ機能でデコードされます。アップロードはされません。

2

モデルはWorkerで動く

WhisperはTransformers.jsとONNX Runtime Webを通じ、バックグラウンドのWeb WorkerでWebGPUまたはCPUを使って動きます。

3

結果はタブの中に残る

文字起こしはページに表示され、下書きは消去するまでこのブラウザのストレージに保存されます。

録音をアップロードせずにブラウザ内で文字起こしした画面

文字起こし ローカル

ローカル文字起こしの仕組みと確かめ方

多くのオンライン文字起こしサービスは、ファイルを自社のサーバーにアップロードします。EarScribeは逆で、モデルをブラウザに持ってきて、録音はその場に残します。

端末に残るもの、残らないもの

端末に残るもの:音声ファイル、デコードした音声、文字起こし、修正内容、書き出したファイル。ネットワークを通るもの:ページ自体、初回のWhisperモデルのファイル、「文字起こし完了」などの集計イベント(ファイル名や本文は含まない)、プライバシーポリシーで説明しているGoogleの広告スクリプトです。

モデルのダウンロード(モデルによって約80 MB〜800 MB)はブラウザにキャッシュされるので、同じ端末では次回から不要です。

ネットワークパネルで確かめる

ChromeやEdgeではF12(MacではOption+Command+I)を押してネットワーク(Network)タブを開きます。Safariは先に「開発」メニューを有効にしてください。一覧をクリアし、ファイルを選んで文字起こしします。初回はモデルファイルのリクエストが見えますが、録音と同じくらいのサイズのリクエストはありません。

サイズで並べ替えるとわかりやすくなります。さらに厳密に確かめるなら、一度文字起こししてモデルをキャッシュしてからページを再読み込みし、2つ目のファイルを処理する間の通信を見てください。

ローカル処理が向いている場面

第三者に渡せない、渡したくない録音に向いています。機密性の高い取材、社内会議、同意書で外部サービスの利用を除外した研究インタビュー、個人的なメモなどです。

ローカル処理だけで端末が安全になるわけではありません。マルウェア、拡張機能、共有アカウントからは開いた内容が見えるので、文字起こしも録音と同じように慎重に扱ってください。

音声をアップロードせず、ブラウザ内でローカルに文字起こしする画面
音声をアップロードせず、ブラウザ内でローカルに文字起こしする画面

書き出す前に文字とタイムスタンプを確認

機密性の高い録音のチェックリスト

  1. 1

    プロファイル

    不要な拡張機能のないブラウザプロファイルを使う。

  2. 2

    確認

    証拠が必要なら一度ネットワークパネルを見る。

  3. 3

    後片付け

    共用端末ではサイトデータを消去して下書きを消す。

  4. 4

    書き出し

    書き出した文字起こしは規程で認められた場所に保存する。

正直な制限

  • EarScribeはWebページで、インストール型のオフラインアプリではありません。読み込みとモデルのダウンロードには接続が必要です。
  • ページはプライバシーポリシーに記載した解析・広告スクリプトも読み込みますが、EarScribeが音声や文字起こしをそれらに送ることはありません。

ローカルでも気をつけたいこと

  • ブラウザの拡張機能はページに表示された内容を読めます。機密性の高い録音には、拡張機能のないブラウザプロファイルを使いましょう。

  • 書き出したファイルと保存された下書きはこの端末に残ります。共用PCでは削除し、サイトデータも消去してください。

  • アップロードしない場合でも、機密情報の扱いは所属組織のルールに従ってください。

この使い方についての質問

音声はどこかにアップロードされますか?

されません。ファイルはブラウザのタブ内で読み込まれて処理され、EarScribeのサーバーには録音も文字起こしも届きません。

ページは何をダウンロード・送信しますか?

ページ自体のコード、初回利用時のWhisperモデル(EarScribeのモデルプロキシ経由)、ファイル名や本文を含まないPlausibleの集計イベント、Googleの広告スクリプトです。どのリクエストにも音声は含まれません。

オフラインで使えますか?

インストール型のオフラインアプリではありません。ページの読み込みと初回のモデルのダウンロードには接続が必要ですが、文字起こし自体はサーバーに依存しません。

自分で確かめるには?

ブラウザの開発者ツールを開いてネットワーク(Network)タブを表示し、ファイルを文字起こししてください。初回はモデルファイルの取得が見えますが、録音を運ぶリクエストは出てきません。

関連する音声ツール