ブラウザがファイルを読む
録音はディスクから開かれ、ブラウザ自身のオーディオ機能でデコードされます。アップロードはされません。
ローカル 文字起こし
EarScribeは、ブラウザのタブの中で録音をデコードして文字起こしします。ファイルがサーバーに送られることはなく、大きなダウンロードは音声モデルだけで、ブラウザがキャッシュします。このページでは、端末に残るもの、ページが送信するもの、そして自分で確かめる方法を説明します。
書き出す前に文字とタイムスタンプを確認
録音はディスクから開かれ、ブラウザ自身のオーディオ機能でデコードされます。アップロードはされません。
WhisperはTransformers.jsとONNX Runtime Webを通じ、バックグラウンドのWeb WorkerでWebGPUまたはCPUを使って動きます。
文字起こしはページに表示され、下書きは消去するまでこのブラウザのストレージに保存されます。

文字起こし ローカル
多くのオンライン文字起こしサービスは、ファイルを自社のサーバーにアップロードします。EarScribeは逆で、モデルをブラウザに持ってきて、録音はその場に残します。
端末に残るもの:音声ファイル、デコードした音声、文字起こし、修正内容、書き出したファイル。ネットワークを通るもの:ページ自体、初回のWhisperモデルのファイル、「文字起こし完了」などの集計イベント(ファイル名や本文は含まない)、プライバシーポリシーで説明しているGoogleの広告スクリプトです。
モデルのダウンロード(モデルによって約80 MB〜800 MB)はブラウザにキャッシュされるので、同じ端末では次回から不要です。
ChromeやEdgeではF12(MacではOption+Command+I)を押してネットワーク(Network)タブを開きます。Safariは先に「開発」メニューを有効にしてください。一覧をクリアし、ファイルを選んで文字起こしします。初回はモデルファイルのリクエストが見えますが、録音と同じくらいのサイズのリクエストはありません。
サイズで並べ替えるとわかりやすくなります。さらに厳密に確かめるなら、一度文字起こししてモデルをキャッシュしてからページを再読み込みし、2つ目のファイルを処理する間の通信を見てください。
第三者に渡せない、渡したくない録音に向いています。機密性の高い取材、社内会議、同意書で外部サービスの利用を除外した研究インタビュー、個人的なメモなどです。
ローカル処理だけで端末が安全になるわけではありません。マルウェア、拡張機能、共有アカウントからは開いた内容が見えるので、文字起こしも録音と同じように慎重に扱ってください。

書き出す前に文字とタイムスタンプを確認
不要な拡張機能のないブラウザプロファイルを使う。
証拠が必要なら一度ネットワークパネルを見る。
共用端末ではサイトデータを消去して下書きを消す。
書き出した文字起こしは規程で認められた場所に保存する。
ブラウザの拡張機能はページに表示された内容を読めます。機密性の高い録音には、拡張機能のないブラウザプロファイルを使いましょう。
書き出したファイルと保存された下書きはこの端末に残ります。共用PCでは削除し、サイトデータも消去してください。
アップロードしない場合でも、機密情報の扱いは所属組織のルールに従ってください。
されません。ファイルはブラウザのタブ内で読み込まれて処理され、EarScribeのサーバーには録音も文字起こしも届きません。
ページ自体のコード、初回利用時のWhisperモデル(EarScribeのモデルプロキシ経由)、ファイル名や本文を含まないPlausibleの集計イベント、Googleの広告スクリプトです。どのリクエストにも音声は含まれません。
インストール型のオフラインアプリではありません。ページの読み込みと初回のモデルのダウンロードには接続が必要ですが、文字起こし自体はサーバーに依存しません。
ブラウザの開発者ツールを開いてネットワーク(Network)タブを表示し、ファイルを文字起こししてください。初回はモデルファイルの取得が見えますが、録音を運ぶリクエストは出てきません。