録音を選ぶ
一般的な音声形式に対応しています。メモリの少ない端末では、短めのファイルとバランス設定が安定します。
音声文字起こしツール
MP3、WAV、M4A、FLAC、OGG、WebMを選ぶと、EarScribeが言語を自動判定し、タイムスタンプ付きで文字起こしします。検索、修正、該当箇所の聞き直し、書き出しまで行え、音声ファイルのアップロードは不要です。
書き出す前に文字とタイムスタンプを確認
一般的な音声形式に対応しています。メモリの少ない端末では、短めのファイルとバランス設定が安定します。
通常はバランス設定のままで十分です。速度や精度を調整したい場合だけ詳細設定を開きます。
人名や専門用語を修正し、気になる箇所を聞き直してから、字幕やメモに必要な形式で保存します。

音声 文字起こし 無料
使える文字起こしは、文章が出て終わりではありません。検索した発言をタイムスタンプから聞き直し、人名や数字を直してから必要な形式で書き出せます。
MP3、WAV、M4A、FLAC、OGG、WebMに対応しています。大きなモデルよりも、声が明瞭でマイクが話者に近いことのほうが結果に影響する場合があります。
初回は選択したWhisperモデルをダウンロードします。同じブラウザではキャッシュを再利用できます。長時間ファイルは端末のメモリに左右されるため、長い無音部分を先に削ると安定しやすくなります。
人名、数字、キーワードを検索し、横のタイムスタンプから該当箇所を聞き直します。見た目には自然でも間違っている単語を見つけやすくなります。
公開や引用の前には、人名、日付、金額、専門用語を元音声と照合してください。EarScribeは確認箇所を見つける道具であり、重要な内容の最終確認は人が行います。
TXTはメモ、SRTやVTTは字幕、JSONはセグメントと時間情報を使う別の処理に向いています。
ワークスペースでの修正はコピーと書き出しに反映されるため、複数のファイルを別々に直す必要がありません。

書き出す前に文字とタイムスタンプを確認
重要な人物名、会社名、地名を聞き直す。
日付、金額、割合、単位を音声と照合する。
引用する一文の前後も聞いて意味を確認する。
次に使う場所に合わせてTXT、SRT、VTT、JSONを選ぶ。
大きなモデルを選ぶだけでなく、人の声が明瞭で雑音が少ないことが重要です。
インタビューでは話者とマイクの距離を近づけ、BGMが声に重ならないようにします。
公開前に人名、数字、商品名、専門用語を録音と照合してください。
MP3、WAV、M4A、OGG、FLAC、WebMなど、ブラウザで再生できる一般的な形式に対応します。
必要ありません。Whisperが録音から言語を自動判定し、結果画面で確認できます。
はい。タイムスタンプごとに修正し、検索や聞き直しを行ったうえで編集済みの内容を書き出せます。