Cómo funciona esta calculadora
Se eliminan las marcas de tiempo en los formatos habituales, como 0:00, 00:00:00, [00:12] y rangos de subtítulo como 00:00:01,000 --> 00:00:04,000. También se quitan los números de línea de archivos SRT y la cabecera WEBVTT.
Opcionalmente, se quitan los nombres de hablantes al inicio de una línea (como “Presentador:”) y etiquetas de sonido como [Música], [Aplausos] y [Risas].
Las líneas cortas de los subtítulos se unen y se reagrupan en párrafos de unas cinco oraciones, lo que facilita mucho leer y resumir la transcripción.
Las horas mencionadas dentro de una frase, como “a las 10:30”, se parecen a las marcas de tiempo y también pueden eliminarse, así que desactiva esa opción si tu transcripción depende de ellas.
Ejemplo resuelto
Una transcripción copiada de YouTube
- Entrada: “0:00 bienvenidos de nuevo al canal / 0:03 hoy vemos / 0:05 tres formas de ahorrar en el súper”.
- Salida: “bienvenidos de nuevo al canal hoy vemos tres formas de ahorrar en el súper”.
- Un video de 20 minutos suele dar unas 3,000 palabras, unos 13 minutos de lectura.
Preguntas frecuentes
¿Cómo obtengo la transcripción de un video de YouTube?
En una computadora, abre el video, haz clic en “…más” bajo el título y elige “Mostrar transcripción”. Usa los tres puntos del panel para ocultar las marcas de tiempo, o copia todo el panel y pégalo aquí.
¿Puedo usar una transcripción limpia para resumir un video con IA?
Sí. Las transcripciones limpias usan menos tokens y son más fáciles de leer para las herramientas de IA. Revisa los términos del creador antes de volver a publicar una transcripción.
¿Funciona con transcripciones de Zoom o Teams?
Sí. Admite archivos VTT y SRT de herramientas de reuniones. Activa la eliminación de hablantes solo si no necesitas saber quién dijo qué.
¿Se sube mi transcripción a algún sitio?
No. La limpieza se hace por completo en tu navegador.
Última revisión: 1 de octubre de 2026