Automatischer Untertitel-Generator
Transkribiert Sprache in zeitgestempelte SRT- oder WebVTT-Untertitel.
Automatischer Untertitel-Generator
Drop your files here
or choose files from your device
So verwendest du Automatischer Untertitel-Generator
The automatic subtitle generator transcribes speech from an audio or video file and returns timestamped captions as SRT or WebVTT. It runs the Whisper tiny model in the browser after a one-time model download. You can leave the language blank for automatic detection or enter a code, and set how many seconds to transcribe from 1 to 120.
- Wähle eine Quelldatei aus. Wenn das Tool mehrere Dateien akzeptiert, ordne sie in der gewünschten Reihenfolge an.
- Lege den Sprachcode (leer = automatisch erkennen), die maximale Dauer und das Untertitelformat fest.
- Führe den automatischen Untertitel-Generator aus, prüfe die Ausgabe und verwende dann die verfügbaren Bedienelemente zum Kopieren oder Herunterladen.
Was dieses Tool unterstützt
Lädt beim ersten Durchlauf ein Browser-Inferenzmodell herunter und verarbeitet die Quelle dann lokal in einem abbrechbaren Web Worker. Die Hintergrundentfernung verwendet BEN2; die Transkription verwendet Whisper tiny. Prüfe Erkennungsfehler und Bildränder.
- Sprachcode (leer = automatisch erkennen)
- Set this value for your task.
- Maximale Dauer (Sekunden)
- Range: 1 to 120
- Untertitelformat
- SRT · WebVTT
Grenzen und Verarbeitung
Bildeingaben: bis zu 32 Megapixel, Stapel mit bis zu 10 Bildern. Audio-/Video-Uploads: 50 MB; Transkription: 120 Sekunden. Bearbeitete Videos: 20 Sekunden, 4 fps und 640 Pixel breit. Übersetzung: Englisch/Spanisch, 30.000 Zeichen; Untertitel: 200 Cues. Neuronale Sprachausgabe: 1.000 englische Zeichen. Modell-Downloads und Speicheranforderungen variieren je nach Gerät.
Beispielquelle
A useful tool makes everyday work easier. Review the results before sharing.
Häufige Fragen
How long a video can I auto-generate subtitles for?
The tool transcribes from the beginning of the file up to the Maximum seconds value, which ranges from 1 to 120 with 30 as the default. Longer recordings need to be split and processed in parts.
Should I set a language code for automatic subtitles?
Leaving it blank lets Whisper detect the language. If detection picks the wrong language, enter a code such as en or fr. When no speech is recognized, the tool asks for a clearer recording.
Can I edit the timing of auto-generated subtitles?
The output is plain SRT or WebVTT text you can copy or download. Review words and timings against the audio, since the tool's notice warns that recognition errors happen. A subtitle timing editor can shift cues afterward.
Wo wird meine Eingabe verarbeitet?
Quelldateien und Text bleiben in diesem Browser. Beim ersten Durchlauf werden öffentliche Modelle von Hugging Face und lokale Laufzeit-Assets von der Website heruntergeladen. Modelle können im Browsercache verbleiben. Es ist kein Upload der Quelle zu Vercel, Supabase oder einem Konvertierungsdienst erforderlich.
Welche Eingabelimits gelten?
Bildeingaben: bis zu 32 Megapixel, Stapel mit bis zu 10 Bildern. Audio-/Video-Uploads: 50 MB; Transkription: 120 Sekunden. Bearbeitete Videos: 20 Sekunden, 4 fps und 640 Pixel breit. Übersetzung: Englisch/Spanisch, 30.000 Zeichen; Untertitel: 200 Cues. Neuronale Sprachausgabe: 1.000 englische Zeichen. Modell-Downloads und Speicheranforderungen variieren je nach Gerät.