Голос / TTS
Дхамма изначально была устным учением. — АН 5.209
Живая демонстрация — голосовой режим включается автоматически через параметр URL, ничего кликать не нужно (главное здесь — плавающий плеер внизу, а не текст ридера под ним):
5 способов включить режим Voice
- Нажать ссылку Voice вверху страницы (рядом с En, Ru и др.).
- Нажать на иконку 🔉 слева от названия текста.
- Кликнуть на любое предложение пали или перевода, чтобы оно выделилось — появится кнопка Play в правом нижнем углу.
- Навести курсор/нажать перед строкой или после неё — появится ссылка ✦, выбрать «Слушать».
- Нажать Alt+R (Option+R на Mac).
Плеер
- Управление — Play/Pause, предыдущее/следующее предложение.
- Навигация — поставьте на паузу, кликните на предложение пали, чтобы выделить его, нажмите Play, чтобы продолжить с этого места.
- Режим — что читать: пали / пали + перевод / перевод / перевод + пали.
- Скорость — кнопка скорости открывает ползунок с готовыми значениями; для пали по умолчанию 0.7× («обычная» для голоса DG).
- Настройки (⚙) — автоскролл, автостарт, пауза между фразами и Voice settings.
Голоса: три вида
В ⚙ → Voice settings голос выбирается отдельно для пали и для перевода, в три шага: вид → язык → голос. Кнопка ▶ рядом с голосом проигрывает короткий образец (голоса DG).
Насколько нам известно, это первые нейросетевые голоса, сделанные для пали. Оба пока в бете и доводятся на слух, звук за звуком, — но раньше такого не было вовсе.
DG Voice — наши бесплатные нейроголоса (по умолчанию)
Работают на нашем сервере: без ключа, без лимитов, ничего не нужно устанавливать.
- Пали
- pratham ♂ · Piper — нейроголос (Piper), который читает пали по нашим собственным правилам произношения пали (буквы → звуки, ударение, долгие гласные), подобранным в слепых раундах прослушивания. Бета.
- o Dhamma.Gift ♂ · beta — голос, обученный на настоящем чтении пали. Произношение ближе к живому пали, качество звука пока грубое, готовится новая версия. Бета.
- Перевод — английский: alan, norman, kathleen; русский: ruslan, irina. Слова пали внутри перевода (sutta, Dhamma, bhikkhu, имена) читаются по-палийски, сокращения раскрываются (Ven. → Venerable, SN 56.11 → Saṁyutta Nikāya 56, 11).
- Следующие фразы готовятся, пока звучит текущая, поэтому пауз между ними нет.
Google — облачные голоса с бесплатным лимитом
Качественные облачные голоса. Пали читает голос пенджаби (pa-IN) через деванагари с нашими поправками. Нужен свой API-ключ Google (см. ниже); бесплатного месячного лимита для личного пользования хватает с запасом.
Встроенные — голоса вашего устройства, работают без интернета
Используется синтез речи системы или браузера: интернет не нужен, ничего никуда не отправляется. Голоса пали нет ни в одной системе, поэтому установите один из голосов Sanskrit (India), Hindi (India), Nepali или Indonesian — это ближе всего к произношению пали; если ни один не установлен, используется английский.
- Android — Настройки → Специальные возможности → Синтез речи, затем установите голосовые данные для языка: справка Android.
- iPhone / iPad — Настройки → Универсальный доступ → Устный контент → Голоса: справка Apple.
- Mac — Системные настройки → Универсальный доступ → Устный контент → Системный голос → Управлять голосами: справка Apple.
- Windows — Параметры → Время и язык → Речь → Управление голосами → Добавление голосов: справка Microsoft.
После установки голоса перезагрузите страницу и выберите его в Voice settings → Встроенные.
A-B цикл — повтор отрывка для заучивания
Кнопка AB рядом с плеером — отдельный инструмент поверх обычного воспроизведения: выбираете начало и конец отрывка, и плеер повторяет именно его — с паузой между повторами и ограничением по числу повторов (или бесконечно).
- Нажмите AB — если в тексте уже была выделена строка, она сразу становится точкой A, и панель ждёт клика по строке для точки B; если ничего не выделено, сначала кликните строку для A, затем — для B. Как только обе точки заданы, повтор запускается автоматически.
- Пауза (сек) — сколько ждать между повторами.
- Число повторов — по умолчанию ∞ (бесконечно), можно вписать своё число — цикл сам остановится, когда повторы закончатся.
- Чтобы сменить точку — нажмите на неё ещё раз и кликните новую строку. Чтобы сбросить точку — правый клик (или долгое нажатие на телефоне) прямо по кнопке A или Б.
- Отрывок между точками подсвечивается в тексте вертикальной чертой слева.
Горячие клавиши
| Клавиша | Действие |
|---|---|
| Alt+R | Вкл/Выкл режим Voice |
| S | Вкл/Выкл автоскролл |
| Space | Воспроизведение / Пауза |
| ← → или ↑ ↓ | Предыдущий / Следующий сегмент |
| 1 | Режим: пали |
| 2 | Режим: пали + перевод |
| 3 | Режим: перевод |
| 4 | Режим: перевод + пали |
| + / - | Увеличить / уменьшить скорость |
| R | Сбросить скорость до значения по умолчанию |
Если «Автоскролл» выключен (кнопка S или переключатель в настройках плеера), пробел и стрелки для управления плеером не реагируют — это рассчитанное поведение, а не баг. Цифры 1–4 и +/- работают всегда, независимо от автоскролла.
Нижняя часть панели
- Voice settings — виды голосов, языки и голоса, образцы, ключ Google.
- Файл — ссылка на аудиофайл, если он есть для этого текста.
- Справка ? — эта страница.
API-ключ Google (необязательно)
Нужен только для голосов Google. Создайте проект в Google Cloud, включите Text-to-Speech API и создайте API-ключ (как начать); вставьте его в Voice settings → Google API Key. Бесплатные лимиты и цены: тарифы Google Cloud. По умолчанию для перевода выбираются более дешёвые голоса Standard, для пали — премиальный.
MP3 для страницы Memo
На странице Memo кнопка ⬇ сохраняет текст одним MP3 выбранным голосом: с голосом DG паузы между строками могут быть любой длины (у Google — не больше 10 секунд).