Generatore automatico di sottotitoli
Trascrive il parlato in sottotitoli SRT o WebVTT con marca temporale.
Generatore automatico di sottotitoli
Drop your files here
or choose files from your device
Come usare Generatore automatico di sottotitoli
The automatic subtitle generator transcribes speech from an audio or video file and returns timestamped captions as SRT or WebVTT. It runs the Whisper tiny model in the browser after a one-time model download. You can leave the language blank for automatic detection or enter a code, and set how many seconds to transcribe from 1 to 120.
- Scegli un file di origine. Se lo strumento accetta più file, disponili nell'ordine desiderato.
- Imposta il codice lingua (vuoto = rileva), i secondi massimi e il formato dei sottotitoli.
- Esegui il generatore automatico di sottotitoli, esamina il risultato, poi usa i controlli disponibili per copiare o scaricare.
Cosa supporta questo strumento
Al primo utilizzo scarica un modello di inferenza per il browser, poi elabora l'origine localmente in un Web Worker annullabile. La rimozione dello sfondo usa BEN2; la trascrizione usa Whisper tiny. Controlla gli errori di riconoscimento e i bordi delle immagini.
- Codice lingua (vuoto = rileva)
- Set this value for your task.
- Secondi massimi
- Range: 1 to 120
- Formato dei sottotitoli
- SRT · WebVTT
Limiti ed elaborazione
Input immagine: fino a 32 megapixel, batch fino a 10 immagini. Caricamenti audio/video: 50 MB; trascrizione: 120 secondi. Video modificati: 20 secondi, 4 fps e 640 pixel di larghezza. Traduzione: inglese/spagnolo, 30.000 caratteri; sottotitoli: 200 cue. Sintesi vocale neurale: 1.000 caratteri inglesi. Download dei modelli e requisiti di memoria variano in base al dispositivo.
Origine di esempio
A useful tool makes everyday work easier. Review the results before sharing.
Domande frequenti
How long a video can I auto-generate subtitles for?
The tool transcribes from the beginning of the file up to the Maximum seconds value, which ranges from 1 to 120 with 30 as the default. Longer recordings need to be split and processed in parts.
Should I set a language code for automatic subtitles?
Leaving it blank lets Whisper detect the language. If detection picks the wrong language, enter a code such as en or fr. When no speech is recognized, the tool asks for a clearer recording.
Can I edit the timing of auto-generated subtitles?
The output is plain SRT or WebVTT text you can copy or download. Review words and timings against the audio, since the tool's notice warns that recognition errors happen. A subtitle timing editor can shift cues afterward.
Dove viene elaborato il mio input?
I file di origine e il testo restano in questo browser. Al primo utilizzo vengono scaricati modelli pubblici da Hugging Face e risorse di runtime locali dal sito. I modelli possono rimanere nella cache del browser. Non è richiesto alcun caricamento dell'origine verso Vercel, Supabase o un servizio di conversione.
Quali sono i limiti di input?
Input immagine: fino a 32 megapixel, batch fino a 10 immagini. Caricamenti audio/video: 50 MB; trascrizione: 120 secondi. Video modificati: 20 secondi, 4 fps e 640 pixel di larghezza. Traduzione: inglese/spagnolo, 30.000 caratteri; sottotitoli: 200 cue. Sintesi vocale neurale: 1.000 caratteri inglesi. Download dei modelli e requisiti di memoria variano in base al dispositivo.