Lector de Texto y Dictado por Voz
Escuche cualquier texto leído en voz alta con voz, velocidad y tono ajustables, o dicte directamente para convertir su voz en texto — gracias a la API Web Speech integrada en su navegador.
220 visitas
Texto a Voz
Tu navegador no admite texto a voz (SpeechSynthesis).
Totalmente local: tu texto y el audio resultante nunca salen de este dispositivo.
Escritura por Voz (Voz a Texto)
Tu navegador no admite el reconocimiento de voz. Usa Chrome o Edge — Firefox y Safari no admiten completamente esta función.
Escuchando… habla ahora
Aviso: a diferencia de la mayoría de las herramientas de este sitio, esta función suele enviar el audio de tu micrófono a un servicio de reconocimiento de voz en la nube (habitualmente el de Google en Chrome) para convertirlo en texto.
Dos APIs de Voz Muy Distintas en una Sola Herramienta
Esta herramienta se basa en la Web Speech API, pero ese único nombre en realidad engloba dos sub-APIs que se comportan de forma completamente diferente. SpeechSynthesis — la mitad "lectora" — convierte el texto escrito en audio usando el motor de voz ya instalado en su sistema operativo o navegador. Funciona por completo en su dispositivo: no se sube ningún texto, no se genera audio de forma remota y nada de lo que escriba sale de su equipo. SpeechRecognition — la mitad de "dictado por voz" — hace justo lo contrario, convierte su voz hablada en texto, y funciona de forma muy distinta por dentro, como se explica más abajo.
La lista de voces del lector se rellena llamando a speechSynthesis.getVoices(), pero esa lista suele cargarse de forma asíncrona — en la primera carga de la página puede devolver una lista vacía aunque existan voces, porque el navegador todavía está enumerando en segundo plano las voces instaladas del sistema operativo. Esta herramienta escucha el evento onvoiceschanged y actualiza el menú desplegable en el momento en que la lista real está lista, que es la solución estándar para una peculiaridad bien conocida de la Web Speech API que confunde a muchas implementaciones ingenuas.
Una Nota de Privacidad que Conviene Leer Antes de Dictar
La mayoría de las herramientas de este sitio procesan todo de forma local y nunca tocan un servidor — eso también es cierto para la mitad de texto a voz de esta herramienta. La conversión de voz a texto es la excepción, y conviene ser claro al respecto: en Chrome y en la mayoría de los navegadores basados en Chromium, SpeechRecognition normalmente envía el audio grabado a un servicio de reconocimiento de voz en la nube (por lo general de Google) para transcribirlo, y luego devuelve el texto a la página. Su voz sale de su dispositivo. Si esto es importante para lo que está dictando, trate el micrófono con la misma precaución que trataría cualquier otro servicio de dictado en la nube.
El soporte de los navegadores para el dictado también está fragmentado de una forma que conviene conocer. Chrome y Edge todavía requieren el constructor con prefijo de proveedor webkitSpeechRecognition en lugar de uno estándar y simple. Firefox solo ofrece soporte parcial oculto tras una bandera experimental que está desactivada por defecto, y el soporte de Safari es limitado e inconsistente entre versiones — por eso, si su navegador no expone la API en absoluto, esta herramienta oculta la sección de dictado en lugar de mostrar un formulario que fallaría en silencio.
- Texto a voz (lectura): totalmente local, sin peticiones de red, funciona prácticamente en todos los navegadores modernos
- Voz a texto (dictado): necesita permiso de micrófono, normalmente se procesa en la nube, fiable sobre todo en Chrome/Edge
- Las voces disponibles dependen por completo de su sistema operativo — Windows, macOS y Android traen cada uno un motor de voz y una lista de voces distintos
Preguntas Frecuentes
¿El lector de texto a voz envía mi texto a un servidor?
No. SpeechSynthesis funciona por completo dentro de su navegador, usando el motor de voz ya instalado en su sistema operativo. Nada de lo que escriba se sube a ningún sitio — ni el texto ni el audio resultante. Incluso podría desconectarse de internet después de cargar la página y el lector seguiría funcionando con normalidad, ya que no necesita obtener nada de forma remota para generar la voz.
¿La función de dictado por voz (voz a texto) envía mi voz a un servidor?
En la mayoría de los navegadores, sí — y conviene saberlo antes de usarla. La implementación de SpeechRecognition de Chrome normalmente transmite el audio de su micrófono a un servicio de transcripción en la nube (por lo general de Google) para convertirlo en texto, y luego devuelve el resultado a la página. Esto es fundamentalmente distinto de la mitad lectora de esta herramienta, que nunca sale de su dispositivo. Si va a dictar algo sensible, téngalo en cuenta igual que lo haría con cualquier asistente de voz basado en la nube.
¿Por qué el menú de voces aparece vacío la primera vez que abro esta herramienta?
Es una peculiaridad conocida de la Web Speech API, no un fallo de esta herramienta. Los navegadores cargan la lista de voces instaladas de forma asíncrona, así que llamar a getVoices() justo al cargar la página puede devolver un array vacío aunque haya voces disponibles. Esta herramienta escucha el evento onvoiceschanged y vuelve a rellenar el menú automáticamente en cuanto la lista real está lista, que es la solución estándar para este comportamiento.
¿Por qué no veo la sección de dictado por voz en Firefox o Safari?
El soporte de los navegadores para SpeechRecognition es desigual. Chrome y Edge lo soportan de forma fiable, todavía mediante el constructor con prefijo webkitSpeechRecognition. Firefox solo ofrece soporte parcial tras una bandera experimental desactivada por defecto, y el soporte de Safari es limitado y poco fiable entre versiones. En lugar de mostrar un formulario de dictado que falla en silencio, esta herramienta detecta si la API existe y, si no, oculta esa sección con un mensaje honesto — pruebe con Chrome o Edge para la experiencia completa de dictado por voz.
¿Por qué las voces que puedo elegir se ven distintas en otro ordenador?
El lector no incluye sus propias voces — usa el motor de voz que proporcione su sistema operativo y navegador, y eso varía mucho. Windows, macOS y Android incluyen cada uno motores de texto a voz distintos, con nombres, idiomas y acentos diferentes, así que la misma página web puede ofrecer una lista de voces completamente distinta en dos equipos diferentes. No hay forma de estandarizar esto desde una página web; depende por completo de lo que esté instalado localmente.
Herramientas Similares
Reportar un Problema
Lector de Texto y Dictado por Voz
Comentarios
Aún no hay comentarios — ¡sé el primero en escribir uno!