更新日志

查看我们产品的最新动态

ScribeToAny v2.3:全新 Plus 套餐与更强的说话人识别

v2.3.0

全新 Plus 套餐、默认展示年付、更清晰的说话人标注、带品牌的 PDF/DOCX 导出,以及新的信任与帮助页面。

2026/09/03

套餐

  • 全新 Plus 套餐:Plus 套餐现已位于 Free 与 Max 之间,为常规使用提供一个中间选择。各套餐分别包含什么,请见价格页
  • 默认展示年付:套餐页现在默认显示年付价格,一眼就能看到全年优惠。切换到月付也只需一次点击。

转录质量

  • 更强的说话人识别:升级后的说话人分离带来更清晰的说话人标注,在长达数小时的录音上也更稳定。

导出

  • 带品牌的 PDF 与 DOCX:面向阅读的 PDF 与 DOCX 导出现在会带上一行小小的「Transcribed with ScribeToAny」页脚(含链接)。字幕与数据格式(SRT、VTT、TSV、CSV、JSON)保持不变。

信任与帮助

  • 新增页面:说明我们如何保护你文件的安全页、帮助中心,以及一份清晰的退款与取消政策
  • 焕新的邮件:事务性邮件(验证、通知)现在采用更清爽的品牌化版式。

ScribeToAny v2.2:免费浏览器工具

v2.2.0

一整套免费的字幕、媒体与图片工具,完全在你的浏览器里运行 —— 不上传、无需账户。

2026/08/25

一整套完全在你浏览器里运行的免费工具 —— 不上传、无需账户、零费用。你的文件绝不离开你的设备。

字幕工具

  • 字幕转换器:在 SRT、VTT、TXT、CSV 与 JSON 之间互转,并可导出为 DOCX 或 PDF。
  • 字幕编辑器:在浏览器里修正字幕条与时间轴,再重新导出。

媒体小工具

  • 提取与转换音频:从视频中抽取音轨,或在各种音频格式之间转换。
  • 视频转换:MP4 → WebM、视频 → GIF。
  • 图片转换:HEIC → JPG。

工作原理

这些工具全部借助 WebCodecs 与 WebAssembly 在本地运行 —— 什么都不会上传到服务器。它们与转录相互独立,且完全免费。在 /tools 浏览全部工具。

ScribeToAny v2.1:翻译成 56 种语言

v2.1.0

把转录完成的文字稿翻译成 56 种语言,且不打乱字幕时间轴。

2026/07/29

翻译

  • 56 种目标语言:发起任务时选定目标语言,转录完成后自动翻译——简体中文、繁体中文、西班牙语、法语、德语、日语、韩语、阿拉伯语、印地语等共 56 种。这份清单是模型真正训练并做过基准评测的语言,而不是它名义上能接受的全部语言码。
  • 时间轴原样保留:翻译逐段进行,每条结果按它原本的时间戳写回。译好的 SRT 或 VTT 可以直接拖进剪辑软件,和画面依然对得上。
  • 两份稿都留着:原文稿和译文并列挂在同一个任务下,都可以按 8 种格式导出。目标语言在任务开始时选定,之后无法更改。

可用范围

翻译属于 Max 套餐。把非英语音频直接转录成英文这一项,所有套餐(含免费)依然都能用。

ScribeToAny v2.0:说话人识别与 8 种导出格式

v2.0.0

带说话人标记的转录稿、直接从链接导入,以及我们支持的全部导出格式。

2026/07/22

全新功能特性

随着众多创作者的大量反馈,我们在 v2.0 带来了数项重量级的效率升级:

  • 说话人识别:采访和会议按说话人分段标记,断句发生在换人处而不是答案中间——两个人的对话读起来终于像对话。
  • 链接导入:粘贴一个直链媒体地址即可抓取并转录,不用先下载再上传。(不支持 YouTube 链接,请先自行下载文件。)
  • 8 种导出格式:除纯文本外,可导出精准时间轴的 SRTVTT 字幕,便于表格处理的 TSVCSV,结构化 JSON,以及可直接排版打印的 PDFDOCX。一次勾选多种会打包成 ZIP。

体验与性能优化

  • 大文件断点续传:全新设计的上传组件,支持最高 5GB 的超大视频文件上传,弱网环境下自动重试。
  • 后台控制台升级:UI 重新设计,增加转写历史搜索、用文件夹归类任务,以及批量导出。
  • 更强的抗噪能力:优化了针对户外采访、嘈杂咖啡厅等场景的人声分离算法。

初始版本:ScribeToAny 正式上线!

v1.0.0

带来极速、精准的音视频转写体验。

2026/07/01

全新核心功能

我们非常激动地宣布 ScribeToAny 首个正式版本发布!专为创作者和专业团队打造的智能转写工具现已可用:

  • 顶级转录引擎:底层接入行业领先的 Whisper 大模型,提供无与伦比的识别准确率。
  • 全格式支持:支持 MP3, WAV, FLAC 以及 MP4, MOV 等主流音视频格式的直接上传。
  • 极速出稿:采用 GPU 矩阵加速,平均仅需 1 分钟即可完成 1 小时长音频的转写。
  • 全球语言支持:支持超过 90 种语言的自动识别和精确转录,无需手动切换语种。
  • 极致数据隐私:所有上传的原始媒体文件将在处理完成后立即自动销毁,绝不用于模型训练。

欢迎体验 ScribeToAny,让声音转化为文字变得前所未有地简单!