動画か音声をドロップしてください。Chrome 内蔵の Gemini Nano がこのタブで書き起こします。ファイルはアップロードしません。
このマシンで初めて使うとき、端末内の Nano モデル(しばしば数 GB)をダウンロードすることがあります。それはモデルであり、あなたの録音ではありません。下の進捗はブラウザ自身の `downloadprogress` で、こちらが作った数字ではありません。
動画または音声ファイルをドロップ
mp4、webm、mov、mp3、wav、m4a — クリックして選んでも可
ブラウザ対応
書き起こしは Chrome の Prompt API に音声を渡します。Firefox と Safari にはありません。Edge は Chromium ですが、この列は実測したことだけを書きます。
| 機能 | Chrome | Edge | Firefox | Safari |
|---|---|---|---|---|
| Prompt API(`LanguageModel`)ウェブの Prompt API は Chrome 148 から。138 は拡張機能専用。Edge は未測定。 | ✓可 | ◐一部 / 未測定 | ✗不可 | ✗不可 |
| 音声のマルチモーダル prompt`expectedInputs: [{ type: "audio" }]` が必要です。API は Chrome 148 以降にあります。このマシンではハードウェアやモデル未取得で unavailable と出ることがあります。その場合 Whisper への逃げ道はありません。Edge は未測定。 | ✓可 | ◐一部 / 未測定 | ✗不可 | ✗不可 |
| タブ内での音声デコードAudioContext / OfflineAudioContext。Window 限定なのでデコード自体は worker に出せません。モノラル化とリサンプルは worker です。 | ✓可 | ✓可 | ✓可 | ✓可 |
今このブラウザ
- LanguageModel …
- LanguageModel audio …
- AudioContext.decodeAudioData …