把 MP3 转成文字

采访、语音备忘、播客,最后往往都是一个 MP3。把文件拖进 ScribeToAny,就能得到一份可编辑、可搜索、可导出的带时间戳文字稿,再也不用来回拖进度条找那一句话。

免费开始转录免费额度:每天 2 个文件、每月 100 分钟,无需绑卡。

使用方法

  1. 1

    上传

    拖入音频或视频文件,或粘贴链接,常见格式全部支持。

  2. 2

    转录

    AI 自动转录,带时间戳,可选说话人识别,通常几分钟完成。

  3. 3

    导出

    在线逐段编辑后,导出 TXT、SRT、VTT、TSV、CSV、JSON、PDF 或 DOCX。

为什么选 ScribeToAny

  • 支持上传 MP3、MP4、M4A、MOV、AAC、WAV、OGG、OPUS、MPEG、WMA、WMV,视频自动提取音轨。
  • 约 98 种语言,自动检测,基于专用 GPU 上的 Whisper 级引擎。
  • 8 种导出格式:TXT、SRT、VTT、TSV、CSV、JSON、PDF、DOCX,还支持批量打包 ZIP。
  • 说话人识别为每段标注发言者,点击任意句子即可回放对应原声。

常见问题

转录一个 MP3 要多久?

远短于录音本身。转录在专用 GPU 上运行,一小时的 MP3 通常几分钟出稿——具体取决于模式:「快速」最快,「准确」用最大模型、稍慢一些。提交后可以直接离开页面,任务在服务端继续跑,回来时工作台会显示实时状态。

多人对话能区分说话人吗?

可以。开始转录时打开说话人识别,每段文字都会标注发言者:双人采访会呈现为清晰的问答,团队会议能看出谁说了什么。约 98 种支持语言全部适用,标注还会保留到 TXT、DOCX、JSON 等导出文件中。

转错的地方能改吗?

能。每一段都可以直接在浏览器里编辑:点击一行修正措辞、整段删除口水话,想核对原话时点击句子即可回放对应音频。TXT、SRT、VTT、TSV、CSV、JSON、PDF、DOCX 这 8 种导出全部基于编辑后的版本生成,改一次就够。

相关工具

把 MP3 转成文字

免费额度:每天 2 个文件、每月 100 分钟,无需绑卡。

免费开始转录