ToolCabana

Note di riunione dall'audio

Esporta una trascrizione con marca temporale ed estrae i candidati alle azioni.

Favorites are saved in this browser. Find them in My favorites.

Note di riunione dall'audio

Your input stays in this browser unless stated otherwise
Clear your input, files and result, and restore the default settings.

Drop your files here

or choose files from your device

Come usare Note di riunione dall'audio

Meeting notes from audio transcribes a recording in the browser and produces a Markdown file with timestamped transcript sections plus a list of action candidates. Action candidates are transcript segments containing phrases such as will, need to, should, action, please or must. You also get a plain transcript.txt, and can process from 1 to 120 seconds.

  1. Scegli un file di origine. Se lo strumento accetta più file, disponili nell'ordine desiderato.
  2. Imposta il codice lingua (vuoto = rileva) e i secondi massimi.
  3. Esegui lo strumento Note di riunione dall'audio, esamina il risultato, poi usa i controlli disponibili per copiare o scaricare.

Cosa supporta questo strumento

La trascrizione locale con Whisper produce sezioni di trascrizione con marca temporale. I candidati alle azioni delle riunioni usano la corrispondenza di frasi; sono bozze estrattive, non un riassunto generato. Controlla gli errori di trascrizione.

Codice lingua (vuoto = rileva)
Set this value for your task.
Secondi massimi
Range: 1 to 120

Limiti ed elaborazione

Input immagine: fino a 32 megapixel, batch fino a 10 immagini. Caricamenti audio/video: 50 MB; trascrizione: 120 secondi. Video modificati: 20 secondi, 4 fps e 640 pixel di larghezza. Traduzione: inglese/spagnolo, 30.000 caratteri; sottotitoli: 200 cue. Sintesi vocale neurale: 1.000 caratteri inglesi. Download dei modelli e requisiti di memoria variano in base al dispositivo.

Origine di esempio
A useful tool makes everyday work easier. Review the results before sharing.

Domande frequenti

Does meeting notes from audio write a summary?

No. It does not generate new text. The notes contain the transcript split into timestamped sections and a list of segments copied word for word because they contain action-like phrases. Review them as a draft.

How are action items found in the transcript?

A segment becomes an action candidate if it contains will, need to, should, action, please or must as whole words. If none match, the notes say no action phrases were detected. Real tasks phrased differently may be missed.

How long a meeting recording can I use?

The tool transcribes from the start of the file up to Maximum seconds, which ranges from 1 to 120 with a default of 30. For longer meetings, split the recording into two-minute parts.

Dove viene elaborato il mio input?

I file di origine e il testo restano in questo browser. Al primo utilizzo vengono scaricati modelli pubblici da Hugging Face e risorse di runtime locali dal sito. I modelli possono rimanere nella cache del browser. Non è richiesto alcun caricamento dell'origine verso Vercel, Supabase o un servizio di conversione.

Quali sono i limiti di input?

Input immagine: fino a 32 megapixel, batch fino a 10 immagini. Caricamenti audio/video: 50 MB; trascrizione: 120 secondi. Video modificati: 20 secondi, 4 fps e 640 pixel di larghezza. Traduzione: inglese/spagnolo, 30.000 caratteri; sottotitoli: 200 cue. Sintesi vocale neurale: 1.000 caratteri inglesi. Download dei modelli e requisiti di memoria variano in base al dispositivo.