ToolCabana

Gerador automático de legendas

Transcreva fala para legendas SRT ou WebVTT com marcas de tempo.

Favorites are saved in this browser. Find them in My favorites.

Gerador automático de legendas

Your input stays in this browser unless stated otherwise
Clear your input, files and result, and restore the default settings.

Drop your files here

or choose files from your device

Como usar Gerador automático de legendas

The automatic subtitle generator transcribes speech from an audio or video file and returns timestamped captions as SRT or WebVTT. It runs the Whisper tiny model in the browser after a one-time model download. You can leave the language blank for automatic detection or enter a code, and set how many seconds to transcribe from 1 to 120.

  1. Escolha um arquivo de origem. Se a ferramenta aceitar vários arquivos, ordene-os como quiser.
  2. Configure o código de idioma (vazio = detectar), os segundos máximos e o formato de legendas.
  3. Execute o gerador automático de legendas, revise a saída e use os controles disponíveis para copiar ou baixar.

O que esta ferramenta suporta

Baixa um modelo de inferência do navegador na primeira execução e depois processa a fonte localmente em um Web Worker cancelável. A remoção de fundo usa BEN2; a transcrição usa Whisper tiny. Revise os erros de reconhecimento e as bordas da imagem.

Código de idioma (vazio = detectar)
Set this value for your task.
Segundos máximos
Range: 1 to 120
Formato de legendas
SRT · WebVTT

Limites e processamento

Entradas de imagem: até 32 megapixels, lotes de até 10 imagens. Uploads de áudio/vídeo: 50 MB; transcrição: 120 segundos. Vídeos editados: 20 segundos, 4 fps e 640 pixels de largura. Tradução: inglês/espanhol, 30,000 caracteres; legendas: 200 entradas. Voz neural: 1,000 caracteres em inglês. Os downloads de modelos e os requisitos de memória variam por dispositivo.

Fonte de exemplo
A useful tool makes everyday work easier. Review the results before sharing.

Perguntas frequentes

How long a video can I auto-generate subtitles for?

The tool transcribes from the beginning of the file up to the Maximum seconds value, which ranges from 1 to 120 with 30 as the default. Longer recordings need to be split and processed in parts.

Should I set a language code for automatic subtitles?

Leaving it blank lets Whisper detect the language. If detection picks the wrong language, enter a code such as en or fr. When no speech is recognized, the tool asks for a clearer recording.

Can I edit the timing of auto-generated subtitles?

The output is plain SRT or WebVTT text you can copy or download. Review words and timings against the audio, since the tool's notice warns that recognition errors happen. A subtitle timing editor can shift cues afterward.

Onde minha entrada é processada?

Os arquivos e o texto de origem permanecem neste navegador. A primeira execução baixa modelos públicos do Hugging Face e recursos locais do ambiente de execução a partir do site. Os modelos podem ficar no cache do navegador. Não é preciso enviar a fonte ao Vercel, Supabase nem a um serviço de conversão.

Quais são os limites de entrada?

Entradas de imagem: até 32 megapixels, lotes de até 10 imagens. Uploads de áudio/vídeo: 50 MB; transcrição: 120 segundos. Vídeos editados: 20 segundos, 4 fps e 640 pixels de largura. Tradução: inglês/espanhol, 30,000 caracteres; legendas: 200 entradas. Voz neural: 1,000 caracteres em inglês. Os downloads de modelos e os requisitos de memória variam por dispositivo.