Audio y vídeo a texto y resumen: transcripción automática de voz, extracción de puntos clave y limpieza de voz
O seleccione un archivo de audio / video (OGG, MP3, WAV, FLAC, M4A, MP4, WebM)
Las conferencias, reuniones o grabaciones de voz se procesan directamente en su dispositivo.
La primera transcripción descarga el modelo Whisper sin conexión seleccionado una vez y luego se almacena en caché. Su archivo nunca sale de su dispositivo.
📖 Vocabulario de términos y nombres específicos (opcional)
Sin él, los nombres raros, los títulos y los términos profesionales se reconocen como palabras cotidianas similares: el nombre de un colega se divide en dos palabras comunes, una marca se convierte en un sustantivo aleatorio, un término de conferencia en una tontería familiar. Enumere esas palabras aquí, separadas por comas, y el modelo las reconocerá con mayor precisión. El resto del discurso no se ve afectado: no se omite ni se fuerza nada para que coincida con la lista.
Configuración rápida:
De 20 a 30 palabras funcionan mejor que una lista larga: el modelo lee solo el comienzo del mensaje y descarta el resto.
¿Un nombre o término reconocido incorrectamente?
¿Es gratis usarlo?
Sí, completamente gratis y sin registro. La herramienta funciona por entero en tu navegador: el archivo nunca sale hacia un servidor, así que el servidor no gasta ni CPU ni tráfico — no hay nada que cobrar. Sin marcas de agua, sin límites de tamaño ni de número de archivos.