Criador de capítulos de transcrição
Crie seções com marcas de tempo a partir de uma transcrição local de fala.
Criador de capítulos de transcrição
Drop your files here
or choose files from your device
Como usar Criador de capítulos de transcrição
The transcript chapter maker transcribes a recording with Whisper in the browser and lists the transcript as numbered sections, each with its start and end time in seconds. Results download as notes.md in Markdown along with a plain transcript.txt. You can set the language or leave it blank for detection, and transcribe from 1 to 120 seconds.
- Escolha um arquivo de origem. Se a ferramenta aceitar vários arquivos, ordene-os como quiser.
- Configure o código de idioma (vazio = detectar) e os segundos máximos.
- Execute o criador de capítulos de transcrição, revise a saída e use os controles disponíveis para copiar ou baixar.
O que esta ferramenta suporta
A transcrição local com Whisper produz seções de transcrição com marcas de tempo. As possíveis ações de reunião usam correspondência de frases; são rascunhos extrativos, não um resumo gerado. Revise os erros de transcrição.
- Código de idioma (vazio = detectar)
- Set this value for your task.
- Segundos máximos
- Range: 1 to 120
Limites e processamento
Entradas de imagem: até 32 megapixels, lotes de até 10 imagens. Uploads de áudio/vídeo: 50 MB; transcrição: 120 segundos. Vídeos editados: 20 segundos, 4 fps e 640 pixels de largura. Tradução: inglês/espanhol, 30,000 caracteres; legendas: 200 entradas. Voz neural: 1,000 caracteres em inglês. Os downloads de modelos e os requisitos de memória variam por dispositivo.
Fonte de exemplo
A useful tool makes everyday work easier. Review the results before sharing.
Perguntas frequentes
Are the chapters based on topics in the audio?
No. Sections follow the timestamped segments Whisper produces, not topic changes. The tool states they are extractive transcript sections rather than generated summaries or semantic chapter boundaries.
What files does the transcript chapter maker produce?
Two downloads: notes.md, a Markdown document with a numbered heading and time range for each section, and transcript.txt containing the full transcript text without timestamps.
How do I turn the sections into YouTube chapters?
Each section heading shows its start time in seconds, such as 12.5. Convert those values to minutes and seconds and choose the sections that mark real topic changes, since the tool does not merge segments by subject.
Onde minha entrada é processada?
Os arquivos e o texto de origem permanecem neste navegador. A primeira execução baixa modelos públicos do Hugging Face e recursos locais do ambiente de execução a partir do site. Os modelos podem ficar no cache do navegador. Não é preciso enviar a fonte ao Vercel, Supabase nem a um serviço de conversão.
Quais são os limites de entrada?
Entradas de imagem: até 32 megapixels, lotes de até 10 imagens. Uploads de áudio/vídeo: 50 MB; transcrição: 120 segundos. Vídeos editados: 20 segundos, 4 fps e 640 pixels de largura. Tradução: inglês/espanhol, 30,000 caracteres; legendas: 200 entradas. Voz neural: 1,000 caracteres em inglês. Os downloads de modelos e os requisitos de memória variam por dispositivo.