Lettore di Testo e Dettatura Vocale

Fai leggere ad alta voce qualsiasi testo con voce, velocità e tono regolabili, oppure detta e converti la tua voce direttamente in testo — grazie alla Web Speech API integrata nel tuo browser.

228 visualizzazioni

Sintesi Vocale (Text to Speech)

Completamente locale: il tuo testo e l'audio generato non lasciano mai questo dispositivo.


Scrittura Vocale (Speech to Text)

Premi "Inizia Ascolto" e parla — le tue parole appariranno qui…

Attenzione: a differenza della maggior parte degli strumenti di questo sito, questa funzione di solito invia l'audio del microfono a un servizio cloud di riconoscimento vocale (solitamente quello di Google in Chrome) per convertirlo in testo.

Due API vocali molto diverse in un unico strumento

Questo strumento si basa sulla Web Speech API, ma quell'unico nome copre in realtà due sotto-API che si comportano in modo completamente diverso. SpeechSynthesis — la metà "lettore" — trasforma il testo digitato in audio usando il motore vocale già installato sul tuo sistema operativo o browser. Funziona interamente sul tuo dispositivo: nessun testo viene caricato, nessun audio viene generato da remoto, e nulla di ciò che digiti lascia mai il tuo computer. SpeechRecognition — la metà "dettatura vocale" — fa il lavoro opposto, trasformando la tua voce parlata in testo, e funziona in modo molto diverso dietro le quinte, come spiegato più avanti.

L'elenco delle voci del lettore viene popolato chiamando speechSynthesis.getVoices(), ma quell'elenco spesso si carica in modo asincrono — al primo caricamento della pagina può tornare vuoto anche se le voci esistono, perché il browser sta ancora enumerando in background le voci installate del sistema operativo. Questo strumento resta in ascolto dell'evento onvoiceschanged e aggiorna il menu a tendina non appena l'elenco reale è pronto, il che è la soluzione standard a una nota stranezza della Web Speech API che inganna molte implementazioni ingenue.

Una nota sulla privacy da leggere prima di dettare

La maggior parte degli strumenti su questo sito elabora tutto localmente e non contatta mai un server — questo vale anche per la metà da testo a voce di questo strumento. La conversione da voce a testo è l'eccezione, ed è importante essere chiari a riguardo: in Chrome e nella maggior parte dei browser basati su Chromium, SpeechRecognition in genere invia l'audio registrato a un servizio di riconoscimento vocale nel cloud (di solito quello di Google) per essere trascritto, poi restituisce il testo alla pagina. La tua voce lascia il tuo dispositivo. Se questo è rilevante per ciò che stai dettando, tratta il microfono come tratteresti qualsiasi altro servizio di dettatura basato su cloud.

Anche il supporto dei browser per la dettatura è frammentato in un modo che vale la pena conoscere. Chrome ed Edge richiedono ancora il costruttore con prefisso del fornitore webkitSpeechRecognition invece di uno semplice e standardizzato. Firefox offre solo un supporto parziale nascosto dietro un flag sperimentale disattivato di default, e il supporto di Safari è limitato e incoerente tra le versioni — per questo, se il tuo browser non espone affatto l'API, questo strumento nasconde la sezione di dettatura invece di mostrare un modulo che fallirebbe silenziosamente.

  • Testo-a-voce (lettura): completamente locale, nessuna richiesta di rete, funziona praticamente in ogni browser moderno
  • Voce-a-testo (dettatura): richiede il permesso del microfono, di solito elaborata nel cloud, affidabile principalmente in Chrome/Edge
  • Le voci disponibili dipendono interamente dal tuo sistema operativo — Windows, macOS e Android forniscono ciascuno un motore vocale e un elenco di voci diverso

Domande Frequenti

Il lettore di testo invia il mio testo a un server?

No. SpeechSynthesis funziona interamente all'interno del tuo browser, usando il motore vocale già installato sul tuo sistema operativo. Nulla di ciò che digiti viene caricato da nessuna parte — né il testo, né l'audio risultante. Potresti persino disconnetterti da internet dopo il caricamento della pagina e il lettore continuerebbe a funzionare normalmente, dato che non recupera nulla da remoto per generare la voce.

La funzione di dettatura vocale (voce-a-testo) invia la mia voce a un server?

Nella maggior parte dei browser sì — ed è bene saperlo prima di usarla. L'implementazione di SpeechRecognition di Chrome in genere trasmette l'audio del microfono a un servizio di trascrizione nel cloud (di solito quello di Google) per convertirlo in testo, poi restituisce il risultato alla pagina. Questo è fondamentalmente diverso dalla metà lettore di questo strumento, che non lascia mai il tuo dispositivo. Se stai dettando qualcosa di sensibile, tienilo presente come faresti con qualsiasi altro assistente vocale basato su cloud.

Perché il menu delle voci è vuoto quando apro questo strumento per la prima volta?

Questa è una stranezza nota della Web Speech API, non un bug di questo strumento. I browser caricano l'elenco delle voci installate in modo asincrono, quindi chiamare getVoices() subito al caricamento della pagina può restituire un array vuoto anche se le voci sono disponibili. Questo strumento resta in ascolto dell'evento onvoiceschanged e ripopola automaticamente il menu a tendina non appena l'elenco reale diventa pronto, il che è la soluzione standard per questo comportamento.

Perché non vedo la sezione di dettatura vocale in Firefox o Safari?

Il supporto dei browser per SpeechRecognition è disomogeneo. Chrome ed Edge lo supportano in modo affidabile, ancora tramite il costruttore con prefisso webkitSpeechRecognition. Firefox offre solo un supporto parziale dietro un flag sperimentale disattivato di default, e il supporto di Safari è limitato e inaffidabile tra le versioni. Invece di mostrare un modulo di dettatura che fallirebbe silenziosamente, questo strumento rileva se l'API esiste e nasconde quella sezione con un messaggio onesto se non esiste — prova Chrome o Edge per l'esperienza completa di dettatura vocale.

Perché le voci tra cui posso scegliere sembrano diverse su un altro computer?

Il lettore non porta con sé voci proprie — usa qualunque motore vocale fornisca il tuo sistema operativo e browser, e questo varia molto. Windows, macOS e Android integrano ciascuno motori text-to-speech diversi con nomi di voce, lingue e accenti diversi, quindi la stessa pagina web può offrire un elenco di voci completamente diverso su due macchine diverse. Non c'è modo di standardizzare questo da una pagina web; è determinato interamente da ciò che è installato localmente.

Commenti

Ancora nessun commento — scrivi il primo!

Strumenti Simili