ToolCabana

Transcription avec locuteurs

Étiquette les segments de transcription à l'aide d'un modèle de diarisation configuré.

Favorites are saved in this browser. Find them in My favorites.

Transcription avec locuteurs

Your input stays in this browser unless stated otherwise
Clear your input, files and result, and restore the default settings.

Drop your files here

or choose files from your device

Comment utiliser Transcription avec locuteurs

  1. Choisissez un fichier source. Si l'outil accepte plusieurs fichiers, classez-les dans l'ordre souhaité.
  2. Définissez le code de langue (vide = détection) et la durée maximale en secondes.
  3. Lancez la transcription avec locuteurs, vérifiez le résultat, puis utilisez les commandes de copie ou de téléchargement disponibles.

Ce que cet outil prend en charge

Les horodatages de mots de Whisper dans le navigateur sont appariés à la segmentation Pyannote sur un extrait de 10 secondes, avec trois emplacements d'interlocuteurs anonymes au maximum. Les étiquettes n'identifient pas les personnes et ne sont pas conservées d'un lancement à l'autre. Vérifiez les chevauchements et les tours de parole courts.

Code de langue (vide = détection)
Set this value for your task.
Durée maximale (secondes)
Range: 1 to 10

Limites et traitement

10 secondes maximum et trois emplacements d'interlocuteurs anonymes. Les étiquettes s'appliquent uniquement à l'extrait sélectionné et ne constituent pas des identités de locuteurs. La première inférence télécharge les modèles de transcription et de segmentation.

Exemple de source
A useful tool makes everyday work easier. Review the results before sharing.

Questions fréquentes

Que fait la transcription avec locuteurs ?

Les horodatages de mots de Whisper dans le navigateur sont appariés à la segmentation Pyannote sur un extrait de 10 secondes, avec trois emplacements d'interlocuteurs anonymes au maximum. Les étiquettes n'identifient pas les personnes et ne sont pas conservées d'un lancement à l'autre. Vérifiez les chevauchements et les tours de parole courts.

Où ma saisie est-elle traitée ?

Les fichiers sources et le texte restent dans ce navigateur. Au premier lancement, des modèles publics sont téléchargés depuis Hugging Face et des ressources d'exécution locales depuis le site. Les modèles peuvent rester dans le cache du navigateur. Aucun envoi de source vers Vercel, Supabase ou un service de conversion n'est nécessaire.

Quelles sont les limites de saisie ?

10 secondes maximum et trois emplacements d'interlocuteurs anonymes. Les étiquettes s'appliquent uniquement à l'extrait sélectionné et ne constituent pas des identités de locuteurs. La première inférence télécharge les modèles de transcription et de segmentation.