Générateur automatique de sous-titres
Transcrit la parole en sous-titres horodatés SRT ou WebVTT.
Générateur automatique de sous-titres
Drop your files here
or choose files from your device
Comment utiliser Générateur automatique de sous-titres
The automatic subtitle generator transcribes speech from an audio or video file and returns timestamped captions as SRT or WebVTT. It runs the Whisper tiny model in the browser after a one-time model download. You can leave the language blank for automatic detection or enter a code, and set how many seconds to transcribe from 1 to 120.
- Choisissez un fichier source. Si l'outil accepte plusieurs fichiers, classez-les dans l'ordre souhaité.
- Définissez le code de langue (vide = détection), les secondes maximales et le format de sous-titres.
- Lancez le générateur automatique de sous-titres, vérifiez le résultat, puis utilisez les commandes de copie ou de téléchargement disponibles.
Ce que cet outil prend en charge
Télécharge un modèle d'inférence du navigateur au premier lancement, puis traite la source localement dans un Web Worker annulable. La suppression d'arrière-plan utilise BEN2 ; la transcription utilise Whisper tiny. Vérifiez les erreurs de reconnaissance et les bords d'image.
- Code de langue (vide = détection)
- Set this value for your task.
- Secondes maximales
- Range: 1 to 120
- Format de sous-titres
- SRT · WebVTT
Limites et traitement
Entrées image : jusqu'à 32 mégapixels, lots jusqu'à 10 images. Imports audio/vidéo : 50 MB ; transcription : 120 secondes. Vidéos modifiées : 20 secondes, 4 fps et 640 pixels de large. Traduction : anglais/espagnol, 30 000 caractères ; sous-titres : 200 répliques. Synthèse vocale neuronale : 1 000 caractères en anglais. Les téléchargements de modèles et les besoins en mémoire varient selon l'appareil.
Exemple de source
A useful tool makes everyday work easier. Review the results before sharing.
Questions fréquentes
How long a video can I auto-generate subtitles for?
The tool transcribes from the beginning of the file up to the Maximum seconds value, which ranges from 1 to 120 with 30 as the default. Longer recordings need to be split and processed in parts.
Should I set a language code for automatic subtitles?
Leaving it blank lets Whisper detect the language. If detection picks the wrong language, enter a code such as en or fr. When no speech is recognized, the tool asks for a clearer recording.
Can I edit the timing of auto-generated subtitles?
The output is plain SRT or WebVTT text you can copy or download. Review words and timings against the audio, since the tool's notice warns that recognition errors happen. A subtitle timing editor can shift cues afterward.
Où ma saisie est-elle traitée ?
Les fichiers sources et le texte restent dans ce navigateur. Le premier lancement télécharge des modèles publics depuis Hugging Face et des ressources d'exécution locales depuis le site. Les modèles peuvent rester dans le cache du navigateur. Aucun envoi de la source vers Vercel, Supabase ou un service de conversion n'est requis.
Quelles sont les limites de saisie ?
Entrées image : jusqu'à 32 mégapixels, lots jusqu'à 10 images. Imports audio/vidéo : 50 MB ; transcription : 120 secondes. Vidéos modifiées : 20 secondes, 4 fps et 640 pixels de large. Traduction : anglais/espagnol, 30 000 caractères ; sous-titres : 200 répliques. Synthèse vocale neuronale : 1 000 caractères en anglais. Les téléchargements de modèles et les besoins en mémoire varient selon l'appareil.