Руководство

Как создать SSML-разметку из текста и настроить голос

Вставьте текст, выберите голос и значения скорости, высоты тона и громкости, затем создайте SSML-разметку. Пустой или состоящий только из пробелов ввод вернёт указание об ошибке вместо разметки.

Инструмент Генератор SSML

Что делает генератор SSML

SSML Generator превращает обычный текст в разметку SSML, которую затем можно использовать в движке синтеза речи. Это удобно, когда нужно подготовить текст для озвучивания и заранее задать голос, скорость, высоту тона и громкость. Инструмент формирует именно разметку, а не аудиозапись, поэтому дальнейшая обработка зависит от выбранного движка text-to-speech.

Входной текст можно оставить без специальной разметки: сервис сам размещает его в SSML-структуре. Переносы строк влияют на результат: непустые строки объединяются в элементы предложений, а двойной перенос отделяет абзацы. Символы, значимые для XML, экранируются перед добавлением в разметку, поэтому текст с такими знаками не следует исправлять вручную без необходимости.

Как создать и настроить разметку

  1. Подготовьте фрагмент текста для озвучивания. Вставьте его в поле ввода как обычный текст. Если в тексте нужны отдельные абзацы, разделите их двойным переносом строки. Учитывайте, что пустая строка сама по себе не создаёт содержательный текст для синтеза.

  2. Выберите имя голоса, если движок, в котором будет использоваться результат, поддерживает такое имя. Можно указать собственное значение; если голос не задан, используется имя default. Название голоса должно соответствовать возможностям последующего text-to-speech-движка, а не только настройке генератора.

  3. Настройте скорость, высоту тона и громкость. Для скорости доступны значения x-slow, slow, medium, fast и x-fast. Для высоты тона используются x-low, low, medium, high и x-high. Для громкости доступны silent, x-soft, soft, medium, loud и x-loud. Выбирайте значения по задаче: например, для учебного текста может подойти более медленная скорость, а для короткого уведомления нужна другая комбинация параметров.

  4. Проверьте написание значений перед созданием результата. Распознанные настройки скорости и высоты преобразуются в относительные процентные значения, а настройка громкости переводится в числовой уровень. Если в поле окажется нераспознанное значение, соответствующий параметр получает настройку medium. Поэтому опечатка может незаметно изменить ожидаемый результат.

  5. Запустите создание разметки и скопируйте полученный SSML в совместимый с ним движок синтеза речи. Перед передачей проверьте структуру вокруг текста, голос и параметры управления речью. При наличии XML-символов не заменяйте экранированные последовательности обратно на исходные знаки: это может нарушить разметку.

Как понимать результат и проверять границы

Результат следует читать как инструкцию для движка синтеза речи, а не как готовую запись. В нём должны отражаться исходный текст, выбранный голос и заданные параметры скорости, высоты и громкости в формате SSML. Конкретное звучание зависит от того, как последующий движок трактует поддерживаемые элементы и значения, поэтому результат стоит проверить в целевой системе.

Если после создания вы видите сообщение об ошибке вместо SSML-разметки, сначала проверьте содержимое входного поля. Текст, состоящий только из пробелов или других пробельных символов, считается пустым: в этом случае операция завершается успешно с указанием ошибки, но разметка речи не создаётся. Добавьте содержательный текст и повторите действие.

Для проверки структуры используйте короткий фрагмент с одним предложением, затем сравните его с вариантом, где есть двойной перенос строки. Так проще увидеть границу абзаца и убедиться, что XML-символы в исходном тексте были обработаны. Если результат не принимается целевым движком, проверьте его требования к SSML и имени голоса: генератор не заявляет гарантированную совместимость с каждым движком синтеза речи.

Практический пример

Редактор готовит два коротких абзаца для последующей передачи в движок синтеза речи и хочет проверить, что структура текста сохранится.

Вставьте фразу «Проверка расписания» и разделите её двойным переносом с фразой «Следующий пункт». Выберите голос, задайте скорость slow, высоту medium и громкость loud, затем создайте разметку и проверьте отдельную границу абзаца.

В результате должна появиться SSML-разметка с указанным текстом, выбранным голосом и параметрами скорости, высоты тона и громкости; аудиозапись при этом не создаётся.

Ограничения

  • Пробельный или пустой ввод не создаёт SSML-разметку, а совместимость результата с конкретным движком синтеза речи не гарантируется.

Частые ошибки

  • Причина: в настройке скорости, высоты или громкости указано значение вне поддерживаемого списка. Исправление: выберите одно из предусмотренных значений; иначе соответствующий параметр будет заменён на medium.

Частые вопросы

Можно ли создать SSML без указания голоса?

Если поле содержит непустой текст, можно оставить голос без собственного имени: по умолчанию используется default. Если целевой движок ожидает другое имя, укажите его перед созданием разметки.

Как переносы строк влияют на SSML?

Двойной перенос строки отделяет абзацы, тогда как непустые строки группируются в элементы предложений. Это влияет на структуру создаваемой SSML-разметки.

Что произойдёт, если оставить только пробелы?

При вводе только пробелов или другого пробельного содержимого операция завершается с указанием ошибки и без созданной разметки. Добавьте текст, который нужно преобразовать, и повторите действие.

Инструмент

Генератор SSML