Lecteur de Texte et Saisie Vocale

Faites lire n'importe quel texte à voix haute avec voix, vitesse et hauteur réglables, ou dictez directement du texte — grâce à l'API Web Speech intégrée à votre navigateur.

222 vues

Synthèse vocale

Entièrement local : votre texte et l'audio généré ne quittent jamais cet appareil.


Saisie vocale (Voix vers texte)

Appuyez sur « Commencer l'écoute » et parlez — vos mots apparaîtront ici…

Attention : contrairement à la plupart des outils de ce site, cette fonctionnalité envoie généralement l'audio de votre microphone à un service de reconnaissance vocale dans le cloud (souvent celui de Google dans Chrome) pour le convertir en texte.

Deux API vocales très différentes réunies dans un seul outil

Cet outil repose sur la Web Speech API, mais ce nom unique recouvre en réalité deux sous-API qui ne se comportent pas du tout de la même façon. SpeechSynthesis — la moitié « lecteur » — transforme le texte saisi en audio à l'aide du moteur vocal déjà installé sur votre système d'exploitation ou votre navigateur. Elle s'exécute entièrement sur votre appareil : aucun texte n'est envoyé, aucun audio n'est généré à distance, et rien de ce que vous tapez ne quitte jamais votre machine. SpeechRecognition — la moitié « saisie vocale » — fait l'inverse, elle transforme votre voix en texte, et fonctionne très différemment en coulisses, comme expliqué ci-dessous.

La liste de voix du lecteur est remplie en appelant speechSynthesis.getVoices(), mais cette liste se charge souvent de façon asynchrone — au premier chargement de la page, elle peut revenir vide alors même que des voix existent, car le navigateur est encore en train d'énumérer en arrière-plan les voix installées sur le système d'exploitation. Cet outil écoute l'événement onvoiceschanged et rafraîchit la liste déroulante dès que la véritable liste est prête, ce qui est la solution standard à une particularité bien connue de la Web Speech API qui piège beaucoup d'implémentations naïves.

Une remarque sur la confidentialité à lire avant de dicter

La plupart des outils de ce site traitent tout localement et ne touchent jamais un serveur — c'est également vrai pour la moitié texte-vers-parole ici. La reconnaissance vocale est l'exception, et il est important de le dire clairement : dans Chrome et la plupart des navigateurs basés sur Chromium, SpeechRecognition envoie généralement votre audio enregistré à un service de reconnaissance vocale dans le cloud (souvent celui de Google) pour être transcrit, puis renvoie le texte à la page. Votre voix quitte votre appareil. Si cela a de l'importance pour ce que vous dictez, traitez le microphone comme vous traiteriez n'importe quel autre service de dictée dans le cloud.

Le support de la dictée par les navigateurs est également fragmenté d'une manière qu'il vaut la peine de connaître. Chrome et Edge exigent encore le constructeur préfixé par le fournisseur webkitSpeechRecognition plutôt qu'un constructeur simple et standardisé. Firefox n'offre qu'un support partiel dissimulé derrière un indicateur expérimental désactivé par défaut, et le support de Safari est limité et incohérent selon les versions — c'est pourquoi, si votre navigateur n'expose pas du tout l'API, cet outil masque la section de dictée plutôt que d'afficher un formulaire qui échouerait silencieusement.

  • Texte-vers-parole (lecture) : entièrement local, aucune requête réseau, fonctionne dans pratiquement tous les navigateurs modernes
  • Parole-vers-texte (dictée) : nécessite l'autorisation du microphone, généralement traité dans le cloud, fiable surtout dans Chrome/Edge
  • Les voix disponibles dépendent entièrement de votre système d'exploitation — Windows, macOS et Android fournissent chacun un moteur vocal et une liste de voix différents

Questions fréquentes

Le lecteur de texte envoie-t-il mon texte à un serveur ?

Non. SpeechSynthesis fonctionne entièrement dans votre navigateur, à l'aide du moteur vocal déjà installé sur votre système d'exploitation. Rien de ce que vous tapez n'est envoyé où que ce soit — ni le texte, ni l'audio produit. Vous pourriez même couper votre connexion internet une fois la page chargée, et le lecteur continuerait à fonctionner normalement, puisqu'il ne récupère rien à distance pour générer la parole.

La saisie vocale (parole-vers-texte) envoie-t-elle ma voix à un serveur ?

Dans la plupart des navigateurs, oui — et il vaut mieux le savoir avant de l'utiliser. L'implémentation de SpeechRecognition par Chrome diffuse généralement l'audio de votre microphone vers un service de transcription dans le cloud (souvent celui de Google) pour le convertir en texte, puis renvoie le résultat à la page. C'est fondamentalement différent de la moitié lecteur de cet outil, qui ne quitte jamais votre appareil. Si vous dictez quelque chose de sensible, gardez cela à l'esprit comme vous le feriez avec n'importe quel assistant vocal basé sur le cloud.

Pourquoi la liste des voix est-elle vide quand j'ouvre cet outil pour la première fois ?

C'est une particularité connue de la Web Speech API, pas un bug de cet outil. Les navigateurs chargent la liste des voix installées de façon asynchrone, donc appeler getVoices() immédiatement au chargement de la page peut renvoyer un tableau vide même si des voix sont disponibles. Cet outil écoute l'événement onvoiceschanged et repeuple automatiquement la liste déroulante dès que la véritable liste devient disponible, ce qui est la solution de contournement standard pour ce comportement.

Pourquoi ne vois-je pas la section de saisie vocale dans Firefox ou Safari ?

Le support de SpeechRecognition par les navigateurs est inégal. Chrome et Edge le prennent en charge de façon fiable, toujours via le constructeur préfixé webkitSpeechRecognition. Firefox n'offre qu'un support partiel derrière un indicateur expérimental désactivé par défaut, et le support de Safari est limité et peu fiable selon les versions. Plutôt que d'afficher un formulaire de dictée qui échouerait silencieusement, cet outil détecte si l'API existe et masque cette section avec un message honnête si ce n'est pas le cas — essayez Chrome ou Edge pour profiter pleinement de la saisie vocale.

Pourquoi les voix que je peux choisir sont-elles différentes sur un autre ordinateur ?

Le lecteur n'intègre pas ses propres voix — il utilise le moteur vocal fourni par votre système d'exploitation et votre navigateur, ce qui varie beaucoup. Windows, macOS et Android embarquent chacun des moteurs de synthèse vocale différents avec des noms de voix, des langues et des accents différents, si bien que la même page web peut proposer une liste de voix totalement différente sur deux machines distinctes. Il n'existe aucun moyen de standardiser cela depuis une page web ; c'est entièrement déterminé par ce qui est installé localement.

Commentaires

Pas encore de commentaires — soyez le premier à en écrire un !

Outils similaires