AI 字幕生成器
一套流程搞定所有字幕活:上传任意音视频文件,ScribeToAny 生成打好时间轴的字幕,在浏览器里校对(需要的话还能标注说话人),再按平台要求的格式导出。
免费开始转录免费额度:每天 2 个文件、每月 100 分钟,无需绑卡。
使用方法
- 1
上传
拖入音频或视频文件,或粘贴链接,常见格式全部支持。
- 2
转录
AI 自动转录,带时间戳,可选说话人识别,通常几分钟完成。
- 3
导出
在线逐段编辑后,导出 TXT、SRT、VTT、TSV、CSV、JSON、PDF 或 DOCX。
为什么选 ScribeToAny
- 支持上传 MP3、MP4、M4A、MOV、AAC、WAV、OGG、OPUS、MPEG、WMA、WMV,视频自动提取音轨。
- 约 98 种语言,自动检测,基于专用 GPU 上的 Whisper 级引擎。
- 8 种导出格式:TXT、SRT、VTT、TSV、CSV、JSON、PDF、DOCX,还支持批量打包 ZIP。
- 说话人识别为每段标注发言者,点击任意句子即可回放对应原声。
常见问题
能导出哪些字幕格式?
字幕用 SRT 和 VTT——SRT 面向剪辑软件和播放器,VTT 面向网页 HTML5 视频;需要带时间的原始数据可导 TXT、TSV、CSV、JSON;要可读文档则有 PDF、DOCX。一次转录得到 8 种格式,高级导出还能任选组合打包成一个 ZIP。
纯音频内容(如播客)也能生成字幕吗?
可以——纯音频生成的字幕与视频完全一样。播客作者常用它给单集配文字稿(顺便让节目能被 Google 检索)、为社交媒体的音频可视化短片配字幕,或向支持字幕的平台提交 SRT/VTT。开启说话人识别后,主播与嘉宾的发言还会自动分开标注。
费用怎么算?
可以免费开始:每天 2 个文件、每月 100 分钟、单文件 30 分钟内,无需绑卡。升级后每月 3000 分钟,单文件最长 3 小时 / 5 GB,6 路并行转录加高优先级处理。8 种导出格式、约 98 种语言和说话人识别在所有方案(包括免费)都可用。
相关工具
AI 字幕生成器
免费额度:每天 2 个文件、每月 100 分钟,无需绑卡。
免费开始转录