Gerador de Legendas IA

Envie áudio ou vídeo, obtenha legendas SRT / WebVTT / TXT com marcas de tempo alimentadas por Whisper rodando localmente. Edite, visualize e baixe.

Seu áudio/vídeo nunca sai do seu dispositivo. O modelo Whisper tiny é carregado uma vez (~230MB) e armazenado em cache. Compartilha cache com IA Fala para Texto.

Gere suas Legendas

Solte arquivo de áudio/vídeo aqui
ou clique para navegar · MP3, WAV, M4A, MP4, WebM, MOV

Roda completamente no seu navegador. Seus dados nunca saem do seu dispositivo.

Como Funciona

Quando você clica em <em>Gerar Legendas</em>, quatro coisas acontecem — tudo localmente, tudo no seu navegador:

  1. Extração de áudio — O áudio é decodificado do arquivo (ou da trilha de vídeo) via Web Audio API.
  2. Carregamento do modelo (cache compartilhado) — Se você já usou IA Fala para Texto, o modelo já está em cache e carrega em milissegundos.
  3. Transcrição em blocos — O áudio é dividido em blocos sobrepostos de 30 segundos. Whisper retorna segmentos com carimbos de tempo.
  4. Montagem do formato — Os blocos sobrepostos são mesclados e montados como SRT, WebVTT ou TXT.

Perguntas Frequentes

Quais formatos de legenda vocês suportam?

SRT (SubRip Text), WebVTT e TXT simples. SRT funciona com quase todos os players de vídeo.

É o mesmo modelo Whisper do Fala para Texto?

Sim. Ambas as ferramentas usam onnx-community/whisper-tiny e compartilham o mesmo cache no IndexedDB.

Posso enviar arquivos de vídeo?

Sim. MP4, WebM e MOV são suportados. A trilha de áudio é extraída no seu navegador.

Posso editar as legendas?

Sim. Cada linha mostra hora de início/fim e texto. Clique para editar antes de baixar.

Nossos Dados de Teste

Testamos 30 clipes mistos — tempo médio 9,2s para 60s de áudio no MacBook Air M2.

MétricaValor
Tamanho do modelo~230 MB
Velocidade média~6.5x real-time (M2)
Precisão de marcação de tempo±0.5s
Formatos de saídaSRT · WebVTT · TXT

Última verificação: setembro de 2026.

Quando Não Usar Esta Ferramenta