Blog

Analyses, actualités et histoires de notre équipe

Running Whisper on Modal from Cloudflare Workers
Engineering2026/09/03

Running Whisper on Modal from Cloudflare Workers

Cloudflare Workers can't run a multi-minute GPU job or Modal's gRPC SDK — so ScribeToAny treats Modal as a plain HTTP endpoint, fires a fire-and-forget spawn, and lets the GPU box call back over a signed webhook. A walk through the async design, the reconciliation backstop, and the sharp edges.
Sous-titres SME vs. sous-titres : quelle différence ?
Guides2026/08/21

Sous-titres SME vs. sous-titres : quelle différence ?

Les sous-titres pour sourds et malentendants (captions) s'adressent aux spectateurs qui ne peuvent pas entendre l'audio et incluent les sons non verbaux ; les sous-titres (subtitles) s'adressent à ceux qui ne comprennent pas la langue et ne traduisent que le dialogue. Une comparaison claire, avec les règles d'accessibilité qui déterminent ce dont vous avez besoin.
Quelle est la précision de la transcription par IA ? Le WER expliqué (2026)
Guides2026/08/21

Quelle est la précision de la transcription par IA ? Le WER expliqué (2026)

Une explication simple du taux d'erreur sur les mots (WER) — comment la précision de la transcription se mesure vraiment, ce que signifient les chiffres, pourquoi même les humains n'atteignent pas 100 %, et les facteurs qui la font monter ou descendre.
Formats de fichiers de sous-titres et de transcriptions expliqués : SRT, VTT, TXT, JSON, CSV et plus
Guides2026/08/21

Formats de fichiers de sous-titres et de transcriptions expliqués : SRT, VTT, TXT, JSON, CSV et plus

Un guide de référence des formats de fichiers que produit la transcription — SRT, VTT, TXT, TSV, CSV, JSON, plus ASS, SSA, SMI et TTML — avec de vrais exemples de chacun et un tableau indiquant quand utiliser lequel.
Qu'est-ce que la diarisation des locuteurs ? Comment l'IA détermine qui a dit quoi
Guides2026/08/21

Qu'est-ce que la diarisation des locuteurs ? Comment l'IA détermine qui a dit quoi

La diarisation des locuteurs est l'étape qui découpe un enregistrement par locuteur — transformant un mur de texte en un dialogue étiqueté. Ce que c'est, en quoi elle diffère de la reconnaissance du locuteur, comment elle fonctionne et où elle peine.
Transcription gratuite de podcast pour les notes d'épisode
Guides2026/08/08

Transcription gratuite de podcast pour les notes d'épisode

Transformez un épisode de podcast en notes d'épisode et sous-titres propres et horodatés — transcrivez l'audio puis exportez en SRT, VTT ou texte brut. Offre gratuite, sans carte bancaire.