Generador IA de Subtítulos

Sube audio o video, obtén subtítulos SRT / WebVTT / TXT con marcas de tiempo impulsados por Whisper corriendo localmente. Edita, previsualiza y descarga.

Tu audio/video nunca sale de tu dispositivo. El modelo Whisper tiny se carga una vez (~230MB) y se cachea localmente. Comparte cache con IA Voz a Texto.

Genera tus Subtítulos

Suelta archivo de audio/video aquí
o haz clic para buscar · MP3, WAV, M4A, MP4, WebM, MOV

Se ejecuta completamente en tu navegador. Tus datos nunca salen de tu dispositivo.

Cómo Funciona

Cuando haces clic en <em>Generar Subtítulos</em>, cuatro cosas pasan — todo localmente, todo en tu navegador:

  1. Extracción de audio — El audio se decodifica desde el archivo (o desde la pista de video) vía Web Audio API.
  2. Carga del modelo (cache compartido) — Si ya usaste IA Voz a Texto, el modelo ya está cacheado y carga en milisegundos.
  3. Transcripción por fragmentos — El audio se divide en fragmentos superpuestos de 30 segundos. Whisper devuelve segmentos con marcas de tiempo.
  4. Ensamblaje de formato — Los fragmentos superpuestos se combinan y se ensamblan como SRT, WebVTT o TXT.

Preguntas Frecuentes

¿Qué formatos de subtítulos soportas?

SRT (SubRip Text), WebVTT y TXT plano. SRT funciona con casi todos los reproductores de video.

¿Es el mismo modelo Whisper que Voz a Texto?

Sí. Ambas herramientas usan onnx-community/whisper-tiny y comparten el mismo cache en IndexedDB.

¿Puedo subir archivos de video?

Sí. MP4, WebM y MOV son soportados. La pista de audio se extrae en tu navegador.

¿Puedo editar los subtítulos?

Sí. Cada línea muestra hora de inicio/fin y texto. Haz clic para editar antes de descargar.

Nuestros Datos de Prueba

Probamos 30 clips mixtos — tiempo promedio 9.2s para 60s de audio en MacBook Air M2.

MétricaValor
Tamaño del modelo~230 MB
Velocidad promedio~6.5x real-time (M2)
Precisión de marcas de tiempo±0.5s
Formatos de salidaSRT · WebVTT · TXT

Última verificación: septiembre de 2026.

Cuándo No Usar Esta Herramienta