動画をテキストに変換

講義・会議・映像素材を検索可能なテキストに。ScribeToAny は動画から音声を自動抽出し、話者ラベルとタイムスタンプ付きで文字起こしします。文をクリックすればその場面にジャンプできます。

無料で文字起こしを始める無料プラン: 1 日 2 ファイル、月 100 分。クレジットカード不要。

使い方

  1. 1

    アップロード

    音声・動画ファイルをドロップするか、リンクを貼り付けてください。一般的な形式にすべて対応しています。

  2. 2

    文字起こし

    AI がタイムスタンプ付きで文字起こしします。話者ラベルも選択可能で、通常は数分で完了します。

  3. 3

    エクスポート

    オンラインでセグメントを編集し、TXT、SRT、VTT、TSV、CSV、JSON、PDF、DOCX でエクスポートできます。

ScribeToAny が選ばれる理由

  • MP3、MP4、M4A、MOV、AAC、WAV、OGG、OPUS、MPEG、WMA、WMV をアップロード可能 — 動画からは音声を自動抽出します。
  • 専用 GPU 上の Whisper クラスのエンジンにより、自動検出付きで約 98 言語に対応。
  • 8 つのエクスポート形式: TXT、SRT、VTT、TSV、CSV、JSON、PDF、DOCX — さらに一括 ZIP エクスポートにも対応。
  • 話者認識がすべてのセグメントにラベルを付けます。任意の文をクリックすると対応する音声を再生できます。

よくある質問

どの動画形式に対応していますか?

MP4、MOV、WEBM、MPEG、MPG、WMV はすべて直接アップロードでき、8 つの音声専用形式にも対応しています。動画を音声に変換する必要はありません。文字起こしの前にサーバー側で音声トラックが抽出され、文字起こしビューでの再生には処理済みの MP3 が使われるため、珍しいコンテナでも問題なく再生できます。有料プランでは最大 5 GB — 数時間分の HD 映像に対応します。

プレーンテキストの代わりに字幕を取得できますか?

はい。すべての文字起こしは SRT または VTT 字幕としてエクスポートでき、タイムスタンプは実際の発話から生成されてセグメント単位で揃います — 手動での同期は不要です。ブラウザで先に行を編集すれば、エクスポートされるファイルにその変更が反映されます。SRT は Premiere Pro、Final Cut、CapCut、DaVinci Resolve、YouTube Studio で使え、VTT は HTML5 ウェブプレーヤーの標準です。

動画はどのくらいの長さまで対応しますか?

無料アカウントでは月 100 分の枠内で最大 30 分のファイルを文字起こしできます。有料プランでは 1 ファイル 3 時間・1 アップロード 5 GB まで拡大され、月 3000 分の文字起こしと最大 6 ファイルの並列処理が可能です — 2 時間の講義動画も GPU パイプラインなら通常数分で完了します。

関連ツール

動画をテキストに変換

無料プラン: 1 日 2 ファイル、月 100 分。クレジットカード不要。

無料で文字起こしを始める