Запись для чтения глазами не всегда однозначна на слух
Дата, сокращение или номер могут иметь несколько вариантов произношения. Например, последовательность цифр может быть номером, количеством или частью кода. Человек часто восстанавливает смысл из контекста, а синтезатор может выбрать другой вариант. Поэтому полезно заранее определить ожидаемое звучание важных фрагментов. Для учебного текста можно раскрыть сокращение и записать дату словами. Но нельзя механически заменять все числа одинаковым способом: у телефонного номера и денежной суммы разные правила чтения. Подготовка должна сохранять смысл, а не только устранять необычные символы.
Язык и голос являются отдельными настройками
В браузерном Web Speech API запрос на произнесение описывается объектом SpeechSynthesisUtterance. В нём можно задавать текст, язык, голос, скорость и другие параметры. Доступные голоса зависят от среды, поэтому нельзя гарантировать одинаковое звучание на любом устройстве. Также следует учитывать готовность списка голосов и события воспроизведения. Выбор приятного тембра не исправит неправильную смысловую подготовку текста. Для проверки полезно сначала использовать короткую понятную фразу, затем добавлять даты, сокращения и другие потенциально неоднозначные участки.
Произнесение и работа скрипта проверяются раздельно
Один вопрос состоит в том, правильно ли звучит фраза. Другой — начинается ли воспроизведение, завершается ли оно и что происходит при повторном нажатии. Если эти проверки смешать, ошибка управления может выглядеть как проблема голоса. Важно также понимать, где выполняется синтез: голос может предоставляться локальной или удалённой службой. Поэтому для первых проверок лучше использовать собственный вымышленный текст без конфиденциальных сведений. Сам факт работы в браузере не доказывает, что все данные обрабатываются только на устройстве.
Попробуйте на практике
Подготовьте бумажный план проверки текста в речь. Реальный запуск скрипта, регистрация и передача текста сервису для задания не требуются.
- Напишите три собственных коротких предложения: обычную фразу, фразу с датой и фразу с условным номером. Не используйте реальные адреса и контакты.
- Рядом запишите ожидаемое произношение даты и номера словами. Объясните, почему одинаковая последовательность цифр может читаться по-разному.
- Укажите язык текста и требования к голосу, сохранив возможность различий между устройствами. Не включайте имитацию узнаваемого человека.
- Составьте отдельные проверки управления: начать, дождаться завершения, остановить и повторить. Для каждой опишите ожидаемый результат без предположения об автоматическом сохранении аудиофайла.
- Отметьте, какие сведения о локальной или удалённой обработке нужно выяснить до использования настоящих документов. Сохраните тестовый текст полностью вымышленным.
Как проверить результат. План готов, если смысловая подготовка, выбор голоса и управление воспроизведением разделены. Для неоднозначных фрагментов задано ожидаемое звучание, а конфиденциальность не предполагается только по внешнему виду приложения.
Частые вопросы
Увеличение скорости всегда делает озвучку удобнее?
Нет. Важны разборчивость, сложность текста и задача слушателя. Настройку скорости оценивают на конкретном материале, не считая максимальное значение лучшим.
Если речь прозвучала, аудиофайл уже создан?
Не обязательно. Воспроизведение и экспорт в файл являются разными возможностями. Наличие одной не подтверждает другую, поэтому это требование нужно проверять отдельно.
Самостоятельный разбор темы. Содержание конкретной обучающей программы здесь не представлено.