Graba con tu micrófono o carga un archivo de audio — obtén una transcripción con marcas de tiempo, editable, impulsada por Whisper que corre completamente en tu navegador.
Tu audio nunca sale de tu dispositivo. El modelo Whisper tiny se carga una vez (~230MB) y se cachea localmente.
Se ejecuta completamente en tu navegador. Tus datos nunca salen de tu dispositivo.
Cuando haces clic en <em>Transcribir</em>, cuatro cosas pasan — todo localmente, todo en tu navegador:
Usamos Whisper Tiny, el modelo Whisper más pequeño (~39M parámetros). Produce buenos resultados para audio claro con un solo hablante, ruido de fondo moderado y acentos.
Whisper Tiny soporta 99 idiomas con detección automática de idioma. El inglés es el más preciso, seguido por español, portugués, francés, alemán, hindi e indonesio.
Los permisos de micrófono son solicitados por tu navegador al hacer clic en <em>Empezar Grabación</em>. El audio se captura localmente a través de la API MediaRecorder y se procesa completamente en tu navegador. Nada se carga a ningún servidor.
Sí. Usamos inferencia por fragmentos: el audio se divide en fragmentos superpuestos de 30 segundos, cada uno transcrito independientemente y luego combinado. Archivos de hasta 30 minutos son prácticos en laptops modernas.
MP3, WAV, M4A y MP4. Para MP4 extraemos automáticamente la pista de audio en el navegador usando la API Web Audio.
Probamos 50 muestras de audio en inglés y español — tiempo promedio de transcripción 6.8s para 60s de audio en MacBook Air M2.
| Métrica | Valor |
|---|---|
| Tamaño del modelo (INT8) | ~230 MB |
| Velocidad promedio | ~8x real-time (M2) |
| Carga del modelo (frío) | ~9s (CDN) / <0.5s (cached) |
| Word Error Rate | ~12% (English clean) |
| Idiomas probados | 5 (EN, ES, PT, ID, FR) |
Última verificación: septiembre de 2026.