Audio a texto
Transcribe el habla de un archivo de audio a texto, completamente en tu dispositivo.
La primera vez que uses esta herramienta, se descarga una única vez un modelo de reconocimiento de voz de ~110 MB (más grande que los ~30 MB de las herramientas de conversión de vídeo/audio, ya que un modelo real de reconocimiento de voz supone muchos más datos que un códec). Después queda en caché, y nada sale nunca de tu dispositivo.
Las grabaciones más largas se procesan en tramos de 30 segundos, así que los archivos más grandes solo tardan más en vez de fallar.
Cómo funciona
- 1Elige un archivo de audio o vídeo.
- 2Elige el idioma hablado, o déjalo en Detección automática.
- 3Transcribe y copia o descarga el texto.
Sobre esta herramienta
Sube un archivo de audio y obtén una transcripción en texto del habla que contiene — una nota de voz, la grabación de una reunión, una entrevista. Un modelo de reconocimiento de voz se ejecuta completamente en tu navegador, así que el audio nunca sale de tu dispositivo. Funciona en 99 idiomas, con detección automática del idioma.
¿Se sube mi audio a algún sitio?
No, el modelo de reconocimiento de voz se ejecuta completamente en tu navegador — nunca se sube nada.
¿Qué idiomas son compatibles?
99 idiomas, ya sea detectados automáticamente o elegidos manualmente en el desplegable.
¿Por qué el primer uso es más lento que los siguientes?
La primera vez que usas esta herramienta hay que descargar una única vez un modelo de reconocimiento de voz de ~110 MB. Después queda en caché, así que las transcripciones siguientes empiezan al instante.
¿Cuánto puede durar el audio?
Cualquier duración — las grabaciones más largas se procesan en tramos de 30 segundos, así que los archivos más grandes solo tardan más en vez de fallar.