Guida

Come generare SSML da testo semplice

Inserisci il testo, scegli voce e controlli di velocità, tono e volume, quindi genera il markup SSML da usare con un motore text-to-speech. Il risultato è markup, non un file audio.

Strumento Generatore SSML

A cosa serve il generatore SSML

Questo strumento trasforma testo semplice in markup SSML, cioè una struttura da utilizzare con motori di sintesi vocale. È utile quando vuoi preparare un testo con una voce indicata e con impostazioni per velocità, tono e volume, senza scrivere manualmente la marcatura. Il risultato non è una registrazione audio: è markup SSML generato a partire dal testo fornito.

Come generare markup SSML da testo

  1. Inserisci il testo nell’area dedicata. Il testo è facoltativo, ma una stringa vuota o composta solo da spazi non produce markup SSML valido: lo strumento termina con un’indicazione di errore.

  2. Seleziona, quando necessario, il nome della voce. Se non ne fornisci uno, viene usato il nome predefinito default.

  3. Imposta la velocità scegliendo tra x-slow, slow, medium, fast e x-fast. Per il tono sono disponibili x-low, low, medium, high e x-high. Per il volume puoi scegliere silent, x-soft, soft, medium, loud o x-loud.

  4. Avvia la generazione e copia il markup ottenuto per usarlo con il motore text-to-speech che preferisci. Prima dell’inserimento, i caratteri XML presenti nel testo vengono convertiti in forma escapata. Le righe non vuote vengono raggruppate in elementi di frase, mentre due interruzioni di riga consecutive separano gli elementi di paragrafo.

  5. Controlla il risultato. I valori riconosciuti di velocità e tono vengono convertiti in percentuali relative; quelli del volume vengono convertiti in livelli numerici. Se un valore non è riconosciuto, la relativa impostazione torna a medium.

Come leggere il risultato

Il risultato è markup SSML destinato a un motore di sintesi vocale. La voce indicata viene riportata nella struttura generata, mentre velocità, tono e volume sono rappresentati secondo le conversioni previste dallo strumento. Un testo con più righe mantiene una distinzione tra frasi e paragrafi; i caratteri che potrebbero essere interpretati come XML vengono invece escapati prima di essere inseriti.

Se un’opzione contiene un valore diverso da quelli riconosciuti, non aspettarti una nuova impostazione personalizzata: la velocità, il tono o il volume interessati ricadono sul livello medium. Se il testo effettivo contiene solo spazi o è vuoto, l’esito è un’indicazione di errore e non markup SSML generato. L’accettazione del risultato dipende poi dal motore text-to-speech con cui lo utilizzi, perché non è dichiarata una compatibilità universale con ogni motore.

Esempio pratico

Stai preparando due brevi paragrafi di testo italiano da inviare a un motore di sintesi vocale e vuoi conservare la separazione tra le due parti.

Inserisci il testo `Ciao !

Benvenuto.; seleziona la voceit-IT-demo, la velocitàslow, il tonohighe il volumeloud`, poi avvia la generazione.

Il risultato ha la forma di markup SSML con la voce selezionata, elementi di frase per le righe non vuote e una separazione tra paragrafi. I caratteri XML del testo compaiono in forma escapata.

Limiti

  • Produce markup SSML e non una registrazione audio. Non è dichiarata una compatibilità universale con ogni motore text-to-speech; inoltre, l’impostazione di accesso alla rete è indicata come disattivata, senza deduzioni sull’ambiente di esecuzione o sulla conservazione dei dati.

Errori comuni

  • Errore: il campo contiene solo spazi o righe vuote. Correzione: inserisci almeno una porzione di testo non vuota prima di avviare la generazione.

Domande frequenti

Cosa succede se lascio vuoto il testo?

Sì, ma con una condizione: il testo non può essere vuoto o composto solo da spazi. In quel caso lo strumento restituisce un’indicazione di errore invece del markup SSML.

Cosa succede con un’impostazione non riconosciuta?

Se il valore non rientra nelle opzioni riconosciute, la relativa impostazione torna a medium. Questo vale separatamente per velocità, tono e volume.

Come vengono trattate le interruzioni di riga?

Una singola interruzione di riga contribuisce al raggruppamento delle righe non vuote negli elementi di frase. Due interruzioni consecutive separano invece gli elementi di paragrafo.

Strumento

Generatore SSML