ToolCabana

Notas de reunión desde audio

Exporta una transcripción con marcas de tiempo y extrae posibles acciones.

Favorites are saved in this browser. Find them in My favorites.

Notas de reunión desde audio

Your input stays in this browser unless stated otherwise
Clear your input, files and result, and restore the default settings.

Drop your files here

or choose files from your device

Cómo usar Notas de reunión desde audio

Meeting notes from audio transcribes a recording in the browser and produces a Markdown file with timestamped transcript sections plus a list of action candidates. Action candidates are transcript segments containing phrases such as will, need to, should, action, please or must. You also get a plain transcript.txt, and can process from 1 to 120 seconds.

  1. Elige un archivo de origen. Si la herramienta acepta varios archivos, ordénalos como quieras.
  2. Configura el código de idioma (vacío = detectar) y los segundos máximos.
  3. Ejecuta las notas de reunión desde audio, revisa la salida y usa los controles disponibles para copiar o descargar.

Qué admite esta herramienta

La transcripción local con Whisper produce secciones de transcripción con marcas de tiempo. Las posibles acciones de reuniones usan coincidencia de frases; son borradores extractivos, no un resumen generado. Revisa los errores de transcripción.

Código de idioma (vacío = detectar)
Set this value for your task.
Segundos máximos
Range: 1 to 120

Límites y procesamiento

Entradas de imagen: hasta 32 megapíxeles, lotes de hasta 10 imágenes. Subidas de audio/vídeo: 50 MB; transcripción: 120 segundos. Vídeos editados: 20 segundos, 4 fps y 640 píxeles de ancho. Traducción: inglés/español, 30,000 caracteres; subtítulos: 200 entradas. Voz neuronal: 1,000 caracteres en inglés. Las descargas de modelos y los requisitos de memoria varían según el dispositivo.

Fuente de ejemplo
A useful tool makes everyday work easier. Review the results before sharing.

Preguntas frecuentes

Does meeting notes from audio write a summary?

No. It does not generate new text. The notes contain the transcript split into timestamped sections and a list of segments copied word for word because they contain action-like phrases. Review them as a draft.

How are action items found in the transcript?

A segment becomes an action candidate if it contains will, need to, should, action, please or must as whole words. If none match, the notes say no action phrases were detected. Real tasks phrased differently may be missed.

How long a meeting recording can I use?

The tool transcribes from the start of the file up to Maximum seconds, which ranges from 1 to 120 with a default of 30. For longer meetings, split the recording into two-minute parts.

¿Dónde se procesa mi entrada?

Los archivos y el texto de origen permanecen en este navegador. La primera ejecución descarga modelos públicos de Hugging Face y recursos locales del entorno de ejecución desde el sitio. Los modelos pueden quedar en la caché del navegador. No se requiere subir la fuente a Vercel, Supabase ni a un servicio de conversión.

¿Cuáles son los límites de entrada?

Entradas de imagen: hasta 32 megapíxeles, lotes de hasta 10 imágenes. Subidas de audio/vídeo: 50 MB; transcripción: 120 segundos. Vídeos editados: 20 segundos, 4 fps y 640 píxeles de ancho. Traducción: inglés/español, 30,000 caracteres; subtítulos: 200 entradas. Voz neuronal: 1,000 caracteres en inglés. Las descargas de modelos y los requisitos de memoria varían según el dispositivo.