Como gerar SSML a partir de texto simples
Introduza texto, escolha opcionalmente a voz e ajuste a velocidade, a altura tonal e o volume para gerar marcação SSML. A saída organiza o conteúdo em frases e parágrafos para utilização posterior num motor de texto para fala.
Para que serve o gerador de SSML
O SSML Generator transforma texto simples em marcação SSML para utilização posterior com motores de conversão de texto em fala. É útil quando precisa de preparar um texto com uma voz definida e controlar a velocidade, a altura tonal e o volume através de valores reconhecidos, sem criar nem reproduzir uma gravação áudio.
O texto introduzido é tratado como texto simples. A ferramenta coloca esse conteúdo na marcação SSML e protege caracteres XML antes de os inserir. Assim, pode preparar frases e parágrafos mantendo uma estrutura legível para o processamento posterior pelo motor de texto para fala.
Como gerar SSML a partir de texto
-
Introduza no campo de texto o conteúdo que pretende converter. O texto é opcional, mas um campo vazio ou composto apenas por espaços não produz marcação de fala: a ferramenta termina com indicação de erro.
-
Se necessário, indique o nome da voz. Quando não fornecer um nome, é usado o valor predefinido
default. -
Escolha a velocidade da fala. Estão disponíveis
x-slow,slow,medium,fastex-fast. Escolha também a altura tonal entrex-low,low,medium,highex-high. -
Defina o volume com uma das opções
silent,x-soft,soft,medium,loudoux-loud. -
Reveja as opções e peça a geração. Os valores reconhecidos de velocidade e altura tonal são convertidos em percentagens relativas; os valores reconhecidos de volume são convertidos em níveis numéricos. Se introduzir um valor que não pertença às opções aceites, a ferramenta recorre à definição média correspondente.
-
Analise a marcação SSML devolvida. Linhas não vazias são agrupadas em elementos de frase, enquanto duas quebras de linha separam elementos de parágrafo. Caracteres que tenham significado especial em XML são convertidos para uma forma protegida dentro da marcação.
Como ler e validar o resultado
O resultado é marcação SSML, não um ficheiro de áudio nem uma reprodução de voz. Para a utilizar, terá de a fornecer posteriormente a um motor de texto para fala que aceite este tipo de marcação. A ferramenta não garante que a marcação seja aceite por todos os motores, por isso deve validar o resultado no sistema onde pretende utilizá-lo.
Ao interpretar a saída, confirme primeiro se o conteúdo aparece dentro da estrutura de marcação esperada. Depois, verifique a organização das frases e dos parágrafos: uma linha não vazia contribui para um elemento de frase, e uma separação por duas quebras de linha cria uma divisão de parágrafo. Se o texto contiver caracteres XML, procure a respetiva forma escapada em vez do carácter original isolado.
As escolhas de velocidade e altura tonal representam níveis relativos, e não valores de tempo ou frequência apresentados ao utilizador. O volume segue uma conversão numérica própria. Se um valor for aceite apenas por semelhança aparente, mas não corresponder a uma opção reconhecida, a saída usa a configuração média daquela categoria. Por isso, reveja a seleção antes de reutilizar a marcação.
Exemplo prático
Está a preparar uma mensagem de boas-vindas com dois parágrafos para a enviar posteriormente a um motor de texto para fala.
Introduza duas linhas sobre uma mensagem de boas-vindas, deixe uma linha vazia entre um primeiro e um segundo parágrafo, selecione fast, high e loud, e peça a geração.
A saída deverá apresentar marcação SSML com elementos de frase para as linhas preenchidas, uma separação de parágrafo entre os dois blocos e caracteres XML protegidos quando existirem.
Limitações
- O resultado é marcação SSML e não áudio. A ferramenta não garante a aceitação da saída por um motor de texto para fala específico.
Erros comuns
- Se a saída indicar um erro sem gerar marcação, verifique se o campo contém texto além de espaços em branco. Introduza pelo menos uma linha com conteúdo antes de pedir novamente a conversão.
Perguntas frequentes
Posso gerar SSML sem introduzir texto?
Sim, desde que o campo contenha texto além de espaços em branco. Um valor vazio ou composto apenas por espaços termina com indicação de erro, sem gerar marcação de fala.
É obrigatório escolher uma voz?
Pode indicar um nome de voz; se não indicar nenhum, é usado o nome predefinido default. A ferramenta gera a marcação, mas a utilização efetiva da voz depende do motor de texto para fala que receber o resultado.
O que acontece se escolher um valor fora da lista?
A ferramenta aceita apenas as opções reconhecidas para cada controlo. Valores de velocidade e altura tonal não reconhecidos passam para medium, enquanto um volume não reconhecido passa para a definição média de volume.