Ce tutoriel présente la mise en place d'un système de synthèse vocale sous Linux, principalement destiné aux utilisateurs d'Archlinux mais adaptable à d'autres distributions. L'objectif est de permettre la lecture de textes par des logiciels, notamment les lecteurs d'écran comme Orca ou la fonction "Mode Lecture" de Firefox. La configuration proposée utilise Speech-Dispatcher comme interface centrale pour gérer les différentes voix et moteurs de synthèse.
L'installation repose sur deux composants principaux : Speech-Dispatcher, l'outil d'interfaçage, et un moteur de synthèse vocale. L'auteur recommande Piper-TTS et détaille l'installation des paquets nécessaires via l'AUR, incluant les voix françaises. La configuration de Speech-Dispatcher implique la génération d'un fichier de configuration initial puis son édition pour spécifier l'utilisation du module générique "piper", le réglage de la langue par défaut en français et l'utilisation de Pipewire pour la sortie audio.
La configuration spécifique de Piper-TTS se fait dans un fichier piper.conf qui définit comment Speech-Dispatcher doit appeler le moteur pour générer la voix. Cela inclut la sélection de la voix souhaitée, le réglage du débit et la gestion des paramètres de sortie. Après chaque modification des fichiers de configuration, le service Speech-Dispatcher doit être relancé pour que les changements prennent effet, et des tests peuvent être effectués avec la commande spd-say.