ToolCabana

Créateur de chapitres de transcription

Crée des sections horodatées à partir d'une transcription vocale locale.

Favorites are saved in this browser. Find them in My favorites.

Créateur de chapitres de transcription

Your input stays in this browser unless stated otherwise
Clear your input, files and result, and restore the default settings.

Drop your files here

or choose files from your device

Comment utiliser Créateur de chapitres de transcription

The transcript chapter maker transcribes a recording with Whisper in the browser and lists the transcript as numbered sections, each with its start and end time in seconds. Results download as notes.md in Markdown along with a plain transcript.txt. You can set the language or leave it blank for detection, and transcribe from 1 to 120 seconds.

  1. Choisissez un fichier source. Si l'outil accepte plusieurs fichiers, classez-les dans l'ordre souhaité.
  2. Définissez le code de langue (vide = détection) et les secondes maximales.
  3. Lancez le créateur de chapitres de transcription, vérifiez le résultat, puis utilisez les commandes de copie ou de téléchargement disponibles.

Ce que cet outil prend en charge

La transcription Whisper locale produit des sections de transcription horodatées. Les candidats d'actions de réunion utilisent la correspondance de phrases ; ce sont des brouillons extractifs, pas un résumé généré. Vérifiez les erreurs de transcription.

Code de langue (vide = détection)
Set this value for your task.
Secondes maximales
Range: 1 to 120

Limites et traitement

Entrées image : jusqu'à 32 mégapixels, lots jusqu'à 10 images. Imports audio/vidéo : 50 MB ; transcription : 120 secondes. Vidéos modifiées : 20 secondes, 4 fps et 640 pixels de large. Traduction : anglais/espagnol, 30 000 caractères ; sous-titres : 200 répliques. Synthèse vocale neuronale : 1 000 caractères en anglais. Les téléchargements de modèles et les besoins en mémoire varient selon l'appareil.

Exemple de source
A useful tool makes everyday work easier. Review the results before sharing.

Questions fréquentes

Are the chapters based on topics in the audio?

No. Sections follow the timestamped segments Whisper produces, not topic changes. The tool states they are extractive transcript sections rather than generated summaries or semantic chapter boundaries.

What files does the transcript chapter maker produce?

Two downloads: notes.md, a Markdown document with a numbered heading and time range for each section, and transcript.txt containing the full transcript text without timestamps.

How do I turn the sections into YouTube chapters?

Each section heading shows its start time in seconds, such as 12.5. Convert those values to minutes and seconds and choose the sections that mark real topic changes, since the tool does not merge segments by subject.

Où ma saisie est-elle traitée ?

Les fichiers sources et le texte restent dans ce navigateur. Le premier lancement télécharge des modèles publics depuis Hugging Face et des ressources d'exécution locales depuis le site. Les modèles peuvent rester dans le cache du navigateur. Aucun envoi de la source vers Vercel, Supabase ou un service de conversion n'est requis.

Quelles sont les limites de saisie ?

Entrées image : jusqu'à 32 mégapixels, lots jusqu'à 10 images. Imports audio/vidéo : 50 MB ; transcription : 120 secondes. Vidéos modifiées : 20 secondes, 4 fps et 640 pixels de large. Traduction : anglais/espagnol, 30 000 caractères ; sous-titres : 200 répliques. Synthèse vocale neuronale : 1 000 caractères en anglais. Les téléchargements de modèles et les besoins en mémoire varient selon l'appareil.