Автоматическая генерация субтитров
Расшифровывает речь в субтитры SRT или WebVTT с отметками времени.
Автоматическая генерация субтитров
Drop your files here
or choose files from your device
Как использовать Автоматическая генерация субтитров
The automatic subtitle generator transcribes speech from an audio or video file and returns timestamped captions as SRT or WebVTT. It runs the Whisper tiny model in the browser after a one-time model download. You can leave the language blank for automatic detection or enter a code, and set how many seconds to transcribe from 1 to 120.
- Выберите исходный файл. Если инструмент принимает несколько файлов, расположите их в нужном порядке.
- Укажите код языка (пусто = автоопределение), максимум секунд и формат субтитров.
- Запустите «Автоматическую генерацию субтитров», просмотрите результат и используйте доступные элементы копирования или скачивания.
Что поддерживает этот инструмент
При первом запуске скачивается браузерная модель вывода, затем исходные данные обрабатываются локально в отменяемом Web Worker. Для удаления фона используется BEN2; для расшифровки — Whisper tiny. Проверяйте ошибки распознавания и края изображения.
- Код языка (пусто = автоопределение)
- Set this value for your task.
- Максимум секунд
- Range: 1 to 120
- Формат субтитров
- SRT · WebVTT
Ограничения и обработка
Изображения на входе: до 32 мегапикселей, пакеты до 10 изображений. Загрузка аудио и видео: 50 МБ; расшифровка: 120 секунд. Отредактированные видео: 20 секунд, 4 кадра/с и 640 пикселей в ширину. Перевод: английский и испанский, 30 000 символов; субтитры: 200 реплик. Нейронная речь: 1 000 английских символов. Скачивание моделей и требования к памяти зависят от устройства.
Пример исходных данных
A useful tool makes everyday work easier. Review the results before sharing.
Частые вопросы
How long a video can I auto-generate subtitles for?
The tool transcribes from the beginning of the file up to the Maximum seconds value, which ranges from 1 to 120 with 30 as the default. Longer recordings need to be split and processed in parts.
Should I set a language code for automatic subtitles?
Leaving it blank lets Whisper detect the language. If detection picks the wrong language, enter a code such as en or fr. When no speech is recognized, the tool asks for a clearer recording.
Can I edit the timing of auto-generated subtitles?
The output is plain SRT or WebVTT text you can copy or download. Review words and timings against the audio, since the tool's notice warns that recognition errors happen. A subtitle timing editor can shift cues afterward.
Где обрабатываются мои данные?
Исходные файлы и текст остаются в этом браузере. При первом запуске скачиваются общедоступные модели с Hugging Face и локальные ресурсы среды выполнения с сайта. Модели могут оставаться в кеше браузера. Загружать исходные данные в Vercel, Supabase или сервис конвертации не требуется.
Каковы ограничения входных данных?
Изображения на входе: до 32 мегапикселей, пакеты до 10 изображений. Загрузка аудио и видео: 50 МБ; расшифровка: 120 секунд. Отредактированные видео: 20 секунд, 4 кадра/с и 640 пикселей в ширину. Перевод: английский и испанский, 30 000 символов; субтитры: 200 реплик. Нейронная речь: 1 000 английских символов. Скачивание моделей и требования к памяти зависят от устройства.