Как создать SSML-разметку из текста и настроить голос
Вставьте текст, выберите голос и значения скорости, высоты тона и громкости, затем создайте SSML-разметку. Пустой или состоящий только из пробелов ввод вернёт указание об ошибке вместо разметки.
Что делает генератор SSML
SSML Generator превращает обычный текст в разметку SSML, которую затем можно использовать в движке синтеза речи. Это удобно, когда нужно подготовить текст для озвучивания и заранее задать голос, скорость, высоту тона и громкость. Инструмент формирует именно разметку, а не аудиозапись, поэтому дальнейшая обработка зависит от выбранного движка text-to-speech.
Входной текст можно оставить без специальной разметки: сервис сам размещает его в SSML-структуре. Переносы строк влияют на результат: непустые строки объединяются в элементы предложений, а двойной перенос отделяет абзацы. Символы, значимые для XML, экранируются перед добавлением в разметку, поэтому текст с такими знаками не следует исправлять вручную без необходимости.
Как создать и настроить разметку
-
Подготовьте фрагмент текста для озвучивания. Вставьте его в поле ввода как обычный текст. Если в тексте нужны отдельные абзацы, разделите их двойным переносом строки. Учитывайте, что пустая строка сама по себе не создаёт содержательный текст для синтеза.
-
Выберите имя голоса, если движок, в котором будет использоваться результат, поддерживает такое имя. Можно указать собственное значение; если голос не задан, используется имя
default. Название голоса должно соответствовать возможностям последующего text-to-speech-движка, а не только настройке генератора. -
Настройте скорость, высоту тона и громкость. Для скорости доступны значения
x-slow,slow,medium,fastиx-fast. Для высоты тона используютсяx-low,low,medium,highиx-high. Для громкости доступныsilent,x-soft,soft,medium,loudиx-loud. Выбирайте значения по задаче: например, для учебного текста может подойти более медленная скорость, а для короткого уведомления нужна другая комбинация параметров. -
Проверьте написание значений перед созданием результата. Распознанные настройки скорости и высоты преобразуются в относительные процентные значения, а настройка громкости переводится в числовой уровень. Если в поле окажется нераспознанное значение, соответствующий параметр получает настройку
medium. Поэтому опечатка может незаметно изменить ожидаемый результат. -
Запустите создание разметки и скопируйте полученный SSML в совместимый с ним движок синтеза речи. Перед передачей проверьте структуру вокруг текста, голос и параметры управления речью. При наличии XML-символов не заменяйте экранированные последовательности обратно на исходные знаки: это может нарушить разметку.
Как понимать результат и проверять границы
Результат следует читать как инструкцию для движка синтеза речи, а не как готовую запись. В нём должны отражаться исходный текст, выбранный голос и заданные параметры скорости, высоты и громкости в формате SSML. Конкретное звучание зависит от того, как последующий движок трактует поддерживаемые элементы и значения, поэтому результат стоит проверить в целевой системе.
Если после создания вы видите сообщение об ошибке вместо SSML-разметки, сначала проверьте содержимое входного поля. Текст, состоящий только из пробелов или других пробельных символов, считается пустым: в этом случае операция завершается успешно с указанием ошибки, но разметка речи не создаётся. Добавьте содержательный текст и повторите действие.
Для проверки структуры используйте короткий фрагмент с одним предложением, затем сравните его с вариантом, где есть двойной перенос строки. Так проще увидеть границу абзаца и убедиться, что XML-символы в исходном тексте были обработаны. Если результат не принимается целевым движком, проверьте его требования к SSML и имени голоса: генератор не заявляет гарантированную совместимость с каждым движком синтеза речи.
Практический пример
Редактор готовит два коротких абзаца для последующей передачи в движок синтеза речи и хочет проверить, что структура текста сохранится.
Вставьте фразу «Проверка расписания» и разделите её двойным переносом с фразой «Следующий пункт». Выберите голос, задайте скорость slow, высоту medium и громкость loud, затем создайте разметку и проверьте отдельную границу абзаца.
В результате должна появиться SSML-разметка с указанным текстом, выбранным голосом и параметрами скорости, высоты тона и громкости; аудиозапись при этом не создаётся.
Ограничения
- Пробельный или пустой ввод не создаёт SSML-разметку, а совместимость результата с конкретным движком синтеза речи не гарантируется.
Частые ошибки
- Причина: в настройке скорости, высоты или громкости указано значение вне поддерживаемого списка. Исправление: выберите одно из предусмотренных значений; иначе соответствующий параметр будет заменён на
medium.
Частые вопросы
Можно ли создать SSML без указания голоса?
Если поле содержит непустой текст, можно оставить голос без собственного имени: по умолчанию используется default. Если целевой движок ожидает другое имя, укажите его перед созданием разметки.
Как переносы строк влияют на SSML?
Двойной перенос строки отделяет абзацы, тогда как непустые строки группируются в элементы предложений. Это влияет на структуру создаваемой SSML-разметки.
Что произойдёт, если оставить только пробелы?
При вводе только пробелов или другого пробельного содержимого операция завершается с указанием ошибки и без созданной разметки. Добавьте текст, который нужно преобразовать, и повторите действие.