Blog
Analyses, actualités et histoires de notre équipe

Engineering2026/09/03
Running Whisper on Modal from Cloudflare Workers
Cloudflare Workers can't run a multi-minute GPU job or Modal's gRPC SDK — so ScribeToAny treats Modal as a plain HTTP endpoint, fires a fire-and-forget spawn, and lets the GPU box call back over a signed webhook. A walk through the async design, the reconciliation backstop, and the sharp edges.

Guides2026/08/21
Sous-titres SME vs. sous-titres : quelle différence ?
Les sous-titres pour sourds et malentendants (captions) s'adressent aux spectateurs qui ne peuvent pas entendre l'audio et incluent les sons non verbaux ; les sous-titres (subtitles) s'adressent à ceux qui ne comprennent pas la langue et ne traduisent que le dialogue. Une comparaison claire, avec les règles d'accessibilité qui déterminent ce dont vous avez besoin.

Guides2026/08/21
Quelle est la précision de la transcription par IA ? Le WER expliqué (2026)
Une explication simple du taux d'erreur sur les mots (WER) — comment la précision de la transcription se mesure vraiment, ce que signifient les chiffres, pourquoi même les humains n'atteignent pas 100 %, et les facteurs qui la font monter ou descendre.

Guides2026/08/21
Formats de fichiers de sous-titres et de transcriptions expliqués : SRT, VTT, TXT, JSON, CSV et plus
Un guide de référence des formats de fichiers que produit la transcription — SRT, VTT, TXT, TSV, CSV, JSON, plus ASS, SSA, SMI et TTML — avec de vrais exemples de chacun et un tableau indiquant quand utiliser lequel.

Guides2026/08/21
Qu'est-ce que la diarisation des locuteurs ? Comment l'IA détermine qui a dit quoi
La diarisation des locuteurs est l'étape qui découpe un enregistrement par locuteur — transformant un mur de texte en un dialogue étiqueté. Ce que c'est, en quoi elle diffère de la reconnaissance du locuteur, comment elle fonctionne et où elle peine.

Guides2026/08/08
Transcription gratuite de podcast pour les notes d'épisode
Transformez un épisode de podcast en notes d'épisode et sous-titres propres et horodatés — transcrivez l'audio puis exportez en SRT, VTT ou texte brut. Offre gratuite, sans carte bancaire.