動画から音声を抽出

MP4、MOV、WebM、MKV をドロップすれば、その音声を MP3 または WAV として取り出せます。ファイルはこのタブ内で WebCodecs によりデコードされ、端末から出ることはありません —— だからサイズ上限もアカウント登録もありません。

すべてブラウザ内で処理されます。ファイルはアップロードされません。

Load an audio or video file to start.

ScribeToAny が選ばれる理由

  • MP3、MP4、M4A、MOV、AAC、WAV、OGG、OPUS、MPEG、WMA、WMV、FLAC、MKV、AVI をアップロード可能 — 動画からは音声を自動抽出します。
  • 専用 GPU 上の Whisper クラスのエンジンにより、自動検出付きで約 98 言語に対応。
  • 8 つのエクスポート形式: TXT、SRT、VTT、TSV、CSV、JSON、PDF、DOCX — さらに一括 ZIP エクスポートにも対応。
  • 話者認識がすべてのセグメントにラベルを付けます。任意の文をクリックすると対応する音声を再生できます。

よくある質問

動画はサーバーにアップロードされますか?

いいえ。動画はローカルで読み込まれ、ブラウザ内で WebCodecs により処理されます。どこにも送信されないため、ファイルサイズの制限もアカウントもありません。

どのブラウザで動作しますか?

Chrome、Edge、Firefox が最適です。Safari の音声エンコード対応は新しく、より限定的なので、そこで失敗する場合は Chromium 系ブラウザをお試しください。

MP3 と WAV のどちらで書き出すべきですか?

共有、アップロード、保存用なら MP3 を選んでください —— サイズがごくわずかで、どこでも再生できます。編集や文字起こしに使う作業用ファイルなら、非圧縮で劣化なく書き出せる WAV を選びます。3 分のクリップなら MP3 は数メガバイトですが、WAV はその約 10 倍になります。可逆圧縮(ロスレス)を保つ明確な理由がない限り、MP3 が安全なデフォルトです。

動画に音声がない場合や、複数の音声トラックがある場合はどうなりますか?

音声トラックがまったくない場合は取り出すものがないため、無音のファイルを書き出すのではなくツールがその旨を通知します。副音声や解説など動画に複数のトラックがある場合は、最初のトラックが抽出されます(ほとんどのファイルでメイン音声が先頭に配置されています)。切り替え可能な音声トラックを持つファイルは DVD や Blu-ray のリッピング以外では稀で、通常の撮影やダウンロード動画は 1 トラックのみです。

音声を抽出すると音質は劣化しますか?

WAV で書き出すとデコードされた音声がそのままコピーされるため、動画内の音声と完全に一致します。MP3 で書き出すと再エンコードされるため非可逆圧縮(ロスあり)となりますが、ツールは高いビットレートで出力し、動画内の音声もすでに圧縮されているため、通常の試聴では違いが聞き分けられません。元の動画に保存されていなかったディテールを取り戻すことはできないため、上限は動画が保存されたときの品質となります。

関連ツール

無料で文字起こしを始める

無料プラン: 1 日 2 ファイル、月 100 分。クレジットカード不要。

無料で文字起こしを始める