Transcription avec locuteurs
Étiquette les segments de transcription à l'aide d'un modèle de diarisation configuré.
Transcription avec locuteurs
Drop your files here
or choose files from your device
Comment utiliser Transcription avec locuteurs
- Choisissez un fichier source. Si l'outil accepte plusieurs fichiers, classez-les dans l'ordre souhaité.
- Définissez le code de langue (vide = détection) et la durée maximale en secondes.
- Lancez la transcription avec locuteurs, vérifiez le résultat, puis utilisez les commandes de copie ou de téléchargement disponibles.
Ce que cet outil prend en charge
Les horodatages de mots de Whisper dans le navigateur sont appariés à la segmentation Pyannote sur un extrait de 10 secondes, avec trois emplacements d'interlocuteurs anonymes au maximum. Les étiquettes n'identifient pas les personnes et ne sont pas conservées d'un lancement à l'autre. Vérifiez les chevauchements et les tours de parole courts.
- Code de langue (vide = détection)
- Set this value for your task.
- Durée maximale (secondes)
- Range: 1 to 10
Limites et traitement
10 secondes maximum et trois emplacements d'interlocuteurs anonymes. Les étiquettes s'appliquent uniquement à l'extrait sélectionné et ne constituent pas des identités de locuteurs. La première inférence télécharge les modèles de transcription et de segmentation.
Exemple de source
A useful tool makes everyday work easier. Review the results before sharing.
Questions fréquentes
Que fait la transcription avec locuteurs ?
Les horodatages de mots de Whisper dans le navigateur sont appariés à la segmentation Pyannote sur un extrait de 10 secondes, avec trois emplacements d'interlocuteurs anonymes au maximum. Les étiquettes n'identifient pas les personnes et ne sont pas conservées d'un lancement à l'autre. Vérifiez les chevauchements et les tours de parole courts.
Où ma saisie est-elle traitée ?
Les fichiers sources et le texte restent dans ce navigateur. Au premier lancement, des modèles publics sont téléchargés depuis Hugging Face et des ressources d'exécution locales depuis le site. Les modèles peuvent rester dans le cache du navigateur. Aucun envoi de source vers Vercel, Supabase ou un service de conversion n'est nécessaire.
Quelles sont les limites de saisie ?
10 secondes maximum et trois emplacements d'interlocuteurs anonymes. Les étiquettes s'appliquent uniquement à l'extrait sélectionné et ne constituent pas des identités de locuteurs. La première inférence télécharge les modèles de transcription et de segmentation.