音声・動画
ここにファイルをドロップ
または
ファイルはこの端末の外に送信されません。
ファイルを選ぶと始められます。
実行方法:—
- 音声の準備
- —
- AIの取得・読み込み
- —
- 文字起こし
- —
ここにファイルをドロップ
または
ファイルはこの端末の外に送信されません。
ファイルを選ぶと始められます。
実行方法:—
Murmurは、日本語の音声をブラウザ内で文字にするツールです。音声・動画を開き、文字起こし結果を確認・修正して、コピーやTXTのダウンロードができます。
音声・動画を1ファイルずつ処理できます。動画は音声だけを取り出して文字にするため、事前に音声ファイルへ変換する手間を減らせます。
完了後は結果欄を直接編集し、固有名詞や聞き間違いを直せます。文章はコピーやUTF-8のTXTファイルで取り出せます。
認識できた区間から表示し、処理中でもコピー・TXTのダウンロードができます。中止やエラーでも、受け取った途中結果を残します。
「ファイルを選ぶ」、またはドロップで開きます。
ファイルの下の「文字起こしを始める」を押します。初回はボタンが「モデルをダウンロードして文字起こし」になり、AIモデルを取得してから始まります。文字起こし中は、音声の波形が文字になったところまで色付きで進み、残り時間の目安が出ます。
完了後に音声と照合し、結果欄を直接編集します。「コピー」または「TXTをダウンロード」で取り出してください。取り出せると、押したボタンに「✓」が付きます。途中結果も取り出せます。
会議の発話を文章にして、決定事項や確認点を整理する前の下書きに使えます。話者の区別や議事録の要約は、別途行ってください。
取材の録音を文章にして、引用したい箇所や話題を探しやすくします。引用する発言は元の音声と照合してから使ってください。
手元にある日本語の動画から発話を取り出し、学習メモや手順書を作る材料にできます。画面内の文字や映像の説明は読み取りません。
文字起こしは、音声の発話を文章にする処理です。Murmurは日本語の文字起こしに対応し、要約・翻訳・話者分離・時刻付き字幕ファイルの出力は行いません。
同じMP4などの拡張子でも、内部の音声形式をブラウザが読み込める必要があります。音声の時間に一律の上限はありませんが、長い録音ほどメモリを使うため、PCでの利用に向いています。
同じ拡張子でも、内部の音声形式にブラウザが対応していない場合があります。音声のない動画も使えません。読み込めない場合は、音声をMP3やWAVに変換して試してください。
初回はAIモデルを取得します。目安はGPU使用時で約2.9 GB、CPU使用時で約1.1 GBです。取得後の文字起こしにも時間がかかり、端末によって速度が変わります。処理中はこのタブを開いたままにしてください。
「中止」やエラーでも、受け取った途中結果は残ります。処理中も「コピー」「TXTをダウンロード」が使えます。処理の途中からの再開には対応していません。処理中は結果を編集できず、完了または中止してから修正できます。
無音や雑音を発話と誤認識したり、認識する区間の境界で抜け・重複が生じたりすることがあります。元の音声と照合し、完了または中止してから結果欄で修正してください。
「TXTをダウンロード」はブラウザのダウンロードを開始します。ボタンの「✓ ダウンロード済み」はダウンロードを始めたという意味で、端末への保存の完了ではありません。ブラウザのダウンロード一覧とダウンロード先を確認してください。自動保存はしないため、結果が表示されている間にもう一度ダウンロードするか、「コピー」で取り出してください。
音声・動画の内容や文字起こし結果をツールからサーバーへ送信しません。APIキーは不要です。モデルはHugging Face、実行に必要なファイルはjsDelivrから取得するため、ダウンロード通信は発生します。
モデルはブラウザの保存領域に保存できた場合に再利用します。ブラウザのデータ削除や容量制限により、再ダウンロードが必要になることがあります。オフラインでの起動は保証していません。
元のファイルは変更しません。文字起こし結果と編集内容は自動保存されないため、再読み込みやタブを閉じる前にコピーかTXTのダウンロードをしてください。TXTのダウンロード先はブラウザの設定に従います。