ToolCabana

Creatore di capitoli da trascrizione

Crea sezioni con marca temporale da una trascrizione vocale locale.

Favorites are saved in this browser. Find them in My favorites.

Creatore di capitoli da trascrizione

Your input stays in this browser unless stated otherwise
Clear your input, files and result, and restore the default settings.

Drop your files here

or choose files from your device

Come usare Creatore di capitoli da trascrizione

The transcript chapter maker transcribes a recording with Whisper in the browser and lists the transcript as numbered sections, each with its start and end time in seconds. Results download as notes.md in Markdown along with a plain transcript.txt. You can set the language or leave it blank for detection, and transcribe from 1 to 120 seconds.

  1. Scegli un file di origine. Se lo strumento accetta più file, disponili nell'ordine desiderato.
  2. Imposta il codice lingua (vuoto = rileva) e i secondi massimi.
  3. Esegui il creatore di capitoli da trascrizione, esamina il risultato, poi usa i controlli disponibili per copiare o scaricare.

Cosa supporta questo strumento

La trascrizione locale con Whisper produce sezioni di trascrizione con marca temporale. I candidati alle azioni delle riunioni usano la corrispondenza di frasi; sono bozze estrattive, non un riassunto generato. Controlla gli errori di trascrizione.

Codice lingua (vuoto = rileva)
Set this value for your task.
Secondi massimi
Range: 1 to 120

Limiti ed elaborazione

Input immagine: fino a 32 megapixel, batch fino a 10 immagini. Caricamenti audio/video: 50 MB; trascrizione: 120 secondi. Video modificati: 20 secondi, 4 fps e 640 pixel di larghezza. Traduzione: inglese/spagnolo, 30.000 caratteri; sottotitoli: 200 cue. Sintesi vocale neurale: 1.000 caratteri inglesi. Download dei modelli e requisiti di memoria variano in base al dispositivo.

Origine di esempio
A useful tool makes everyday work easier. Review the results before sharing.

Domande frequenti

Are the chapters based on topics in the audio?

No. Sections follow the timestamped segments Whisper produces, not topic changes. The tool states they are extractive transcript sections rather than generated summaries or semantic chapter boundaries.

What files does the transcript chapter maker produce?

Two downloads: notes.md, a Markdown document with a numbered heading and time range for each section, and transcript.txt containing the full transcript text without timestamps.

How do I turn the sections into YouTube chapters?

Each section heading shows its start time in seconds, such as 12.5. Convert those values to minutes and seconds and choose the sections that mark real topic changes, since the tool does not merge segments by subject.

Dove viene elaborato il mio input?

I file di origine e il testo restano in questo browser. Al primo utilizzo vengono scaricati modelli pubblici da Hugging Face e risorse di runtime locali dal sito. I modelli possono rimanere nella cache del browser. Non è richiesto alcun caricamento dell'origine verso Vercel, Supabase o un servizio di conversione.

Quali sono i limiti di input?

Input immagine: fino a 32 megapixel, batch fino a 10 immagini. Caricamenti audio/video: 50 MB; trascrizione: 120 secondi. Video modificati: 20 secondi, 4 fps e 640 pixel di larghezza. Traduzione: inglese/spagnolo, 30.000 caratteri; sottotitoli: 200 cue. Sintesi vocale neurale: 1.000 caratteri inglesi. Download dei modelli e requisiti di memoria variano in base al dispositivo.