Blog
Ideas, novedades e historias de nuestro equipo

Engineering2026/09/03
Running Whisper on Modal from Cloudflare Workers
Cloudflare Workers can't run a multi-minute GPU job or Modal's gRPC SDK — so ScribeToAny treats Modal as a plain HTTP endpoint, fires a fire-and-forget spawn, and lets the GPU box call back over a signed webhook. A walk through the async design, the reconciliation backstop, and the sharp edges.

Guías2026/08/21
Subtítulos para sordos vs. subtítulos: ¿cuál es la diferencia?
Los subtítulos para sordos (captions) son para espectadores que no pueden oír el audio e incluyen sonidos no verbales; los subtítulos (subtitles) son para quienes no entienden el idioma y solo traducen el diálogo. Una comparación clara, con las reglas de accesibilidad que deciden cuál necesitas.

Guías2026/08/21
¿Qué precisión tiene la transcripción con IA? El WER explicado (2026)
Una explicación sencilla de la tasa de error de palabra (WER) — cómo se mide realmente la precisión de la transcripción, qué significan los números, por qué ni siquiera los humanos llegan al 100 % y los factores que la suben o la bajan.

Guías2026/08/21
Formatos de archivo de subtítulos y transcripciones explicados: SRT, VTT, TXT, JSON, CSV y más
Una guía de referencia de los formatos de archivo que produce la transcripción — SRT, VTT, TXT, TSV, CSV, JSON, además de ASS, SSA, SMI y TTML — con ejemplos reales de cada uno y una tabla de cuándo usar cuál.

Guías2026/08/21
¿Qué es la diarización de hablantes? Cómo la IA averigua quién dijo qué
La diarización de hablantes es el paso que divide una grabación por hablante — convirtiendo un muro de texto en un diálogo etiquetado. Qué es, en qué se diferencia del reconocimiento de hablante, cómo funciona y dónde falla.

Guías2026/08/08
Transcripción gratis de pódcast para las notas del episodio
Convierte un episodio de pódcast en notas del episodio y subtítulos limpios y con marcas de tiempo — transcribe el audio y luego exporta SRT, VTT o texto plano. Plan gratuito, sin tarjeta de crédito.