Trascrizione con etichette interlocutori
Etichetta i segmenti della trascrizione con un modello di diarizzazione configurato.
Trascrizione con etichette interlocutori
Drop your files here
or choose files from your device
Come usare Trascrizione con etichette interlocutori
- Scegli un file di origine. Se lo strumento accetta più file, disponili nell'ordine desiderato.
- Imposta il codice lingua (vuoto = rileva) e i secondi massimi.
- Esegui Trascrizione con etichette interlocutori, esamina il risultato, poi usa i controlli disponibili per copiare o scaricare.
Cosa supporta questo strumento
I timestamp delle parole di Whisper nel browser vengono confrontati con la segmentazione Pyannote all'interno di un estratto di 10 secondi, con un massimo di tre slot anonimi per gli interlocutori. Le etichette non identificano le persone e non persistono tra un'esecuzione e l'altra. Controlla le sovrapposizioni e i turni brevi.
- Codice lingua (vuoto = rileva)
- Set this value for your task.
- Secondi massimi
- Range: 1 to 10
Limiti ed elaborazione
Fino a 10 secondi, tre slot anonimi per gli interlocutori. Le etichette si applicano solo all'estratto selezionato e non sono identità degli interlocutori. La prima inferenza scarica i modelli di trascrizione e segmentazione.
Origine di esempio
A useful tool makes everyday work easier. Review the results before sharing.
Domande frequenti
Che cosa fa Trascrizione con etichette interlocutori?
I timestamp delle parole di Whisper nel browser vengono confrontati con la segmentazione Pyannote all'interno di un estratto di 10 secondi, con un massimo di tre slot anonimi per gli interlocutori. Le etichette non identificano le persone e non persistono tra un'esecuzione e l'altra. Controlla le sovrapposizioni e i turni brevi.
Dove viene elaborato il mio input?
I file di origine e il testo restano in questo browser. Al primo utilizzo vengono scaricati modelli pubblici da Hugging Face e risorse di runtime locali dal sito. I modelli possono rimanere nella cache del browser. Non è richiesto alcun caricamento dell'origine verso Vercel, Supabase o un servizio di conversione.
Quali sono i limiti di input?
Fino a 10 secondi, tre slot anonimi per gli interlocutori. Le etichette si applicano solo all'estratto selezionato e non sono identità degli interlocutori. La prima inferenza scarica i modelli di trascrizione e segmentazione.