Перейти к основному содержимому

Голос / TTS

Дхамма изначально была устным учением. — АН 5.209

Живая демонстрация — голосовой режим включается автоматически через параметр URL, ничего кликать не нужно (главное здесь — плавающий плеер внизу, а не текст ридера под ним):

5 способов включить режим Voice​

  1. Нажать ссылку Voice вверху страницы (рядом с En, Ru и др.).
  2. Нажать на иконку 🔉 слева от названия текста.
  3. Кликнуть на любое предложение пали или перевода, чтобы оно выделилось — появится кнопка Play в правом нижнем углу.
  4. Навести курсор/нажать перед строкой или после неё — появится ссылка ✦, выбрать «Слушать».
  5. Нажать Alt+R (Option+R на Mac).

Плеер​

  • Управление — Play/Pause, предыдущее/следующее предложение.
  • Навигация — поставьте на паузу, кликните на предложение пали, чтобы выделить его, нажмите Play, чтобы продолжить с этого места.
  • Режим — что читать: пали / пали + перевод / перевод / перевод + пали.
  • Скорость — кнопка скорости открывает ползунок с готовыми значениями; для пали по умолчанию 0.7× («обычная» для голоса DG).
  • Настройки (⚙) — автоскролл, автостарт, пауза между фразами и Voice settings.

Голоса: три вида​

В ⚙ → Voice settings голос выбирается отдельно для пали и для перевода, в три шага: вид → язык → голос. Кнопка ▶ рядом с голосом проигрывает короткий образец (голоса DG).

Первые нейроголоса пали

Насколько нам известно, это первые нейросетевые голоса, сделанные для пали. Оба пока в бете и доводятся на слух, звук за звуком, — но раньше такого не было вовсе.

DG Voice — наши бесплатные нейроголоса (по умолчанию)​

Работают на нашем сервере: без ключа, без лимитов, ничего не нужно устанавливать.

  • Пали
    • pratham ♂ · Piper — нейроголос (Piper), который читает пали по нашим собственным правилам произношения пали (буквы → звуки, ударение, долгие гласные), подобранным в слепых раундах прослушивания. Бета.
    • o Dhamma.Gift ♂ · beta — голос, обученный на настоящем чтении пали. Произношение ближе к живому пали, качество звука пока грубое, готовится новая версия. Бета.
  • Перевод — английский: alan, norman, kathleen; русский: ruslan, irina. Слова пали внутри перевода (sutta, Dhamma, bhikkhu, имена) читаются по-палийски, сокращения раскрываются (Ven. → Venerable, SN 56.11 → Saṁyutta Nikāya 56, 11).
  • Следующие фразы готовятся, пока звучит текущая, поэтому пауз между ними нет.

Google — облачные голоса с бесплатным лимитом​

Качественные облачные голоса. Пали читает голос пенджаби (pa-IN) через деванагари с нашими поправками. Нужен свой API-ключ Google (см. ниже); бесплатного месячного лимита для личного пользования хватает с запасом.

Встроенные — голоса вашего устройства, работают без интернета​

Используется синтез речи системы или браузера: интернет не нужен, ничего никуда не отправляется. Голоса пали нет ни в одной системе, поэтому установите один из голосов Sanskrit (India), Hindi (India), Nepali или Indonesian — это ближе всего к произношению пали; если ни один не установлен, используется английский.

  • Android — Настройки → Специальные возможности → Синтез речи, затем установите голосовые данные для языка: справка Android.
  • iPhone / iPad — Настройки → Универсальный доступ → Устный контент → Голоса: справка Apple.
  • Mac — Системные настройки → Универсальный доступ → Устный контент → Системный голос → Управлять голосами: справка Apple.
  • Windows — Параметры → Время и язык → Речь → Управление голосами → Добавление голосов: справка Microsoft.

После установки голоса перезагрузите страницу и выберите его в Voice settings → Встроенные.

A-B цикл — повтор отрывка для заучивания​

Кнопка AB рядом с плеером — отдельный инструмент поверх обычного воспроизведения: выбираете начало и конец отрывка, и плеер повторяет именно его — с паузой между повторами и ограничением по числу повторов (или бесконечно).

Панель A-B цикла: точки A/B, пауза между повторами, счётчик повторов
  • Нажмите AB — если в тексте уже была выделена строка, она сразу становится точкой A, и панель ждёт клика по строке для точки B; если ничего не выделено, сначала кликните строку для A, затем — для B. Как только обе точки заданы, повтор запускается автоматически.
  • Пауза (сек) — сколько ждать между повторами.
  • Число повторов — по умолчанию ∞ (бесконечно), можно вписать своё число — цикл сам остановится, когда повторы закончатся.
  • Чтобы сменить точку — нажмите на неё ещё раз и кликните новую строку. Чтобы сбросить точку — правый клик (или долгое нажатие на телефоне) прямо по кнопке A или Б.
  • Отрывок между точками подсвечивается в тексте вертикальной чертой слева.

Горячие клавиши​

КлавишаДействие
Alt+RВкл/Выкл режим Voice
SВкл/Выкл автоскролл
SpaceВоспроизведение / Пауза
← → или ↑ ↓Предыдущий / Следующий сегмент
1Режим: пали
2Режим: пали + перевод
3Режим: перевод
4Режим: перевод + пали
+ / -Увеличить / уменьшить скорость
RСбросить скорость до значения по умолчанию
Space и стрелки работают только при включённом автоскролле

Если «Автоскролл» выключен (кнопка S или переключатель в настройках плеера), пробел и стрелки для управления плеером не реагируют — это рассчитанное поведение, а не баг. Цифры 1–4 и +/- работают всегда, независимо от автоскролла.

Нижняя часть панели​

  • Voice settings — виды голосов, языки и голоса, образцы, ключ Google.
  • Файл — ссылка на аудиофайл, если он есть для этого текста.
  • Справка ? — эта страница.

API-ключ Google (необязательно)​

Нужен только для голосов Google. Создайте проект в Google Cloud, включите Text-to-Speech API и создайте API-ключ (как начать); вставьте его в Voice settings → Google API Key. Бесплатные лимиты и цены: тарифы Google Cloud. По умолчанию для перевода выбираются более дешёвые голоса Standard, для пали — премиальный.

MP3 для страницы Memo​

На странице Memo кнопка ⬇ сохраняет текст одним MP3 выбранным голосом: с голосом DG паузы между строками могут быть любой длины (у Google — не больше 10 секунд).