Audio a Texto (IA)
Transcribe cualquier audio con IA, 100% en tu navegador. Tu audio nunca se sube a ningún servidor.
Arrastra tu audio aquí o haz clic para seleccionar
MP3, WAV, OGG, FLAC, M4A, AAC, Opus, MP4 · sin límite de tamaño artificial
Hecho por
Miguel Ángel Colorado Marin (MACM)
Hecho por
Miguel Ángel Colorado Marin (MACM)
Full-Stack Developer · Guadalajara, España
Desarrollo aplicaciones web, herramientas digitales y proyectos completos — desde el diseño hasta el despliegue.
El transcriptor de audio a texto usa Whisper, el modelo de reconocimiento de voz de código abierto de OpenAI, ejecutado enteramente dentro de tu navegador con WebGPU o WebAssembly — tu audio nunca se sube a ningún servidor. Antes de transcribir, un modelo de detección de voz (Silero VAD) localiza los tramos donde realmente hay alguien hablando y descarta los silencios, así que el resultado no se rompe ni se repite en grabaciones largas con pausas. Sube una grabación, una nota de voz, un podcast o cualquier archivo de audio (MP3, WAV, OGG, FLAC, M4A, AAC, Opus o MP4), elige el modelo (rápido, preciso o máxima calidad) y el idioma, y en unos segundos tienes el texto transcrito, listo para editar, copiar o descargar como .txt. La primera vez que lo uses los modelos se descargan y quedan en caché en tu navegador, así que las siguientes transcripciones son mucho más rápidas. Es la misma tecnología que usan servicios de pago, pero corriendo en tu propio dispositivo, sin coste, sin límite artificial de tamaño y sin que tu audio salga nunca de tu ordenador o móvil — el único límite real es lo que tu propio equipo pueda procesar.
Características
- ✓Modelo Whisper de OpenAI (código abierto)
- ✓Detección automática de idioma
- ✓Sin límite de minutos
- ✓Editar, copiar y descargar .txt
- ✓100% en el navegador, sin subir tu audio
¿Cómo transcribir un audio a texto?
- 1
Sube tu audio
Arrastra el archivo o haz clic para seleccionarlo. Sin límite artificial de tamaño.
- 2
Elige el modelo y el idioma
Rápido, preciso o máxima calidad, y el idioma del audio (o auto-detectar).
- 3
Pulsa Transcribir
La primera vez descarga el modelo de IA; luego queda en caché.
- 4
Edita, copia o descarga
El texto es editable directamente. Cópialo o descárgalo como .txt.
Preguntas frecuentes
¿Se sube mi audio a un servidor?
No. El modelo Whisper corre dentro de tu navegador con WebGPU o WebAssembly. El audio nunca sale de tu dispositivo.
¿Qué diferencia hay entre los tres modelos?
Rápido (~75 MB) transcribe antes pero con algo menos de precisión. Preciso (~150 MB) es el equilibrio recomendado. Máxima calidad (~1 GB, Whisper large-v3-turbo) tarda más y pesa más pero acierta más, sobre todo con acentos, audio con ruido o vocabulario específico.
¿Hay límite de tamaño?
No hay límite artificial — el límite real es lo que tu dispositivo pueda decodificar y procesar. Archivos muy grandes simplemente tardan más.
¿Qué formatos e idiomas soporta?
MP3, WAV, OGG, FLAC, M4A, AAC, Opus y MP4 como entrada. Whisper es multilenguaje: puedes elegir español, inglés, francés, alemán, italiano, portugués o dejar que lo detecte automáticamente.
¿Es siempre 100% preciso?
No, como cualquier IA de transcripción, aunque la detección de voz previa evita el fallo más común (repetirse en bucle durante audios largos con pausas). Sigue pudiendo equivocarse con acentos muy marcados, ruido de fondo fuerte o vocabulario muy técnico — revisa siempre el resultado, y si algo no cuadra prueba "Máxima calidad" o fuerza el idioma en vez de dejarlo en automático.
Herramientas relacionadas
Incrusta Audio a Texto (IA) en tu web
Integra Audio a Texto (IA) en cualquier página web con un simple iframe. Gratis, con atribución a miguelacm.es.
<iframe
src="https://miguelacm.es/embed/audio-to-text"
width="100%"
height="700"
frameborder="0"
title="Audio a Texto (IA) — miguelacm.es"
></iframe>Ver embed en nueva pestaña →