Empieza con una grabación corta

Abre Audio a texto en Chrome de escritorio y elige un audio claro. Indica el idioma hablado. Base es el modelo predeterminado; tiny es menor, pero puede cometer más errores. Small es una mejora opcional con una descarga mayor, más uso de memoria y, normalmente, más tiempo de procesamiento. Los límites de 200 MB y 20 minutos no garantizan esa capacidad en todos los dispositivos.

Entiende la primera descarga

Antes de reconocer la voz se descarga el modelo. Base necesita unos 206 MB para GPU o 77 MB para CPU, más unos 21 MB del programa y archivos de configuración. La caché puede evitar repetir la descarga, pero borrar datos o cambiar de versión puede exigirla otra vez. Mantén la pestaña abierta.

Qué permanece en tu dispositivo

La grabación y el texto se quedan en el navegador. La web y los modelos públicos sí generan solicitudes de red; no se promete disponibilidad completa sin conexión. Descarga TXT o subtítulos antes de cerrar, ya que no hay recuperación de proyectos en la nube.

Ejemplo

Elige 10 segundos de audio → indica el idioma → inicia → revisa → descarga TXT