Guide

Comment générer du SSML à partir d’un texte brut

Saisissez un texte brut, choisissez éventuellement une voix, un débit, une hauteur et un volume, puis générez le balisage SSML à utiliser avec un moteur de synthèse vocale.

Outil Générateur SSML

Préparer du SSML à partir d’un texte

Le générateur SSML transforme un texte brut en balisage Speech Synthesis Markup Language destiné à un moteur de synthèse vocale. Il convient lorsque vous devez préparer le contenu d’une lecture vocale tout en contrôlant la voix, le débit, la hauteur et le volume dans le balisage produit. Il ne crée ni ne lit un enregistrement audio : il fournit une structure SSML à utiliser ensuite avec un moteur de synthèse vocale compatible.

Procédure

  1. Saisissez le texte à transformer dans le champ prévu à cet effet. Le texte est facultatif, mais une valeur vide ou composée uniquement d’espaces ne produit pas de balisage vocal et renvoie une indication d’erreur.

  2. Indiquez, si nécessaire, un nom de voix. Si vous ne renseignez pas ce champ, la voix utilisée dans le balisage porte la valeur par défaut « default ».

  3. Choisissez un débit parmi « x-slow », « slow », « medium », « fast » et « x-fast ». Sélectionnez ensuite une hauteur parmi « x-low », « low », « medium », « high » et « x-high », puis un volume parmi « silent », « x-soft », « soft », « medium », « loud » et « x-loud ».

  4. Lancez la génération et examinez le balisage obtenu. Les valeurs reconnues de débit et de hauteur sont converties en pourcentages relatifs ; les valeurs reconnues de volume deviennent des niveaux numériques. Une valeur non reconnue revient au réglage « medium » correspondant.

  5. Utilisez le SSML généré avec votre moteur de synthèse vocale. Avant de l’intégrer, vérifiez que ce moteur accepte le balisage et les réglages employés, car l’acceptation du résultat n’est pas garantie pour chaque moteur.

Lire et vérifier le résultat

Le résultat est un balisage SSML, et non un fichier audio. Le texte fourni est échappé pour XML avant son insertion dans le balisage, ce qui protège la structure lorsque le contenu contient des caractères réservés au XML. Les lignes non vides sont regroupées dans des éléments de phrase. Deux retours à la ligne consécutifs servent à séparer des éléments de paragraphe.

Pour contrôler le rendu attendu, relisez d’abord la voix et les réglages choisis, puis observez la structure correspondant aux phrases et aux paragraphes de votre texte. Si une option saisie n’est pas reconnue, le résultat peut employer « medium » pour le débit, la hauteur ou le volume concerné. Une sortie réussie ne signifie donc pas que chaque valeur entrée a été conservée telle quelle.

Le balisage doit ensuite être interprété par un moteur de synthèse vocale approprié. La génération seule ne permet pas de conclure que ce moteur acceptera toutes les options, ni qu’il produira un rendu identique selon son propre fonctionnement.

Exemple pratique

Vous préparez une courte phrase d’accueil destinée à être traitée ensuite par un moteur de synthèse vocale.

Saisissez « Bonjour, bienvenue. » sur une ligne, choisissez une voix nommée et les réglages « slow », « high » et « soft », puis lancez la génération.

Le résultat prend la forme d’un balisage SSML contenant la phrase fournie, avec une voix indiquée et les réglages de débit, de hauteur et de volume correspondants. Le contenu est encapsulé dans une structure de phrase, sans produire de fichier audio.

Limites

  • La génération ne garantit pas l’acceptation du balisage par un moteur de synthèse vocale donné.

Erreurs fréquentes

  • Cause : le champ contient uniquement des espaces ou aucun texte exploitable. Action : saisissez au moins du contenu non blanc avant de lancer la génération.

Questions fréquentes

Puis-je lancer la génération sans texte ?

Oui, le texte peut être omis, car il est facultatif. Toutefois, une valeur vide ou composée uniquement d’espaces renvoie une indication d’erreur au lieu de produire du balisage SSML.

Quelle voix est utilisée si je ne renseigne pas ce réglage ?

La voix par défaut est « default » lorsque vous ne fournissez pas de nom de voix. Vous pouvez aussi saisir un nom de voix pour l’inclure dans le balisage généré.

Le résultat est-il un fichier audio ?

Le résultat contient du balisage SSML destiné à un moteur de synthèse vocale ; l’outil ne fournit pas un enregistrement audio. Vérifiez ensuite que le moteur choisi accepte le balisage et ses réglages.

Outil

Générateur SSML