把 MP3 转成文字
采访、语音备忘、播客,最后往往都是一个 MP3。把文件拖进 ScribeToAny,就能得到一份可编辑、可搜索、可导出的带时间戳文字稿,再也不用来回拖进度条找那一句话。
免费开始转录免费额度:每天 2 个文件、每月 100 分钟,无需绑卡。
使用方法
- 1
上传
拖入音频或视频文件,或粘贴链接,常见格式全部支持。
- 2
转录
AI 自动转录,带时间戳,可选说话人识别,通常几分钟完成。
- 3
导出
在线逐段编辑后,导出 TXT、SRT、VTT、TSV、CSV、JSON、PDF 或 DOCX。
为什么选 ScribeToAny
- 支持上传 MP3、MP4、M4A、MOV、AAC、WAV、OGG、OPUS、MPEG、WMA、WMV,视频自动提取音轨。
- 约 98 种语言,自动检测,基于专用 GPU 上的 Whisper 级引擎。
- 8 种导出格式:TXT、SRT、VTT、TSV、CSV、JSON、PDF、DOCX,还支持批量打包 ZIP。
- 说话人识别为每段标注发言者,点击任意句子即可回放对应原声。
常见问题
转录一个 MP3 要多久?
远短于录音本身。转录在专用 GPU 上运行,一小时的 MP3 通常几分钟出稿——具体取决于模式:「快速」最快,「准确」用最大模型、稍慢一些。提交后可以直接离开页面,任务在服务端继续跑,回来时工作台会显示实时状态。
多人对话能区分说话人吗?
可以。开始转录时打开说话人识别,每段文字都会标注发言者:双人采访会呈现为清晰的问答,团队会议能看出谁说了什么。约 98 种支持语言全部适用,标注还会保留到 TXT、DOCX、JSON 等导出文件中。
转错的地方能改吗?
能。每一段都可以直接在浏览器里编辑:点击一行修正措辞、整段删除口水话,想核对原话时点击句子即可回放对应音频。TXT、SRT、VTT、TSV、CSV、JSON、PDF、DOCX 这 8 种导出全部基于编辑后的版本生成,改一次就够。
相关工具
把 MP3 转成文字
免费额度:每天 2 个文件、每月 100 分钟,无需绑卡。
免费开始转录