Диалог двух голосов
Маша Семёнова5 шагов3 мин
Сверено с интерфейсом
- Что понадобится:
- Аккаунт Most AI, баланс и текст, разбитый на реплики
- Сколько стоит:
- От 5 ₽ за генерацию — на рубль дороже одиночной озвучки
В каталоге две модели ElevenLabs, и различить их проще всего по подсказке в поле ввода. У Диктора там «Введите текст для озвучки», у Диалога — «Введите реплику».
Разница не косметическая: Диалог рассчитан на разговор нескольких голосов, а не на сплошной текст.
Стоит от 5 ₽ — на рубль дороже одиночной озвучки.
Шаг 1. Выберите модель на вкладке «Аудио»
Наведите курсор на вкладку «Аудио» и выберите ElevenLabs V3 (Диалог). В описании прямо сказано: «Генерация диалогов с несколькими голосами».
Шаг 2. Убедитесь, что панель пустая
Справа, как и у остальных аудиомоделей, только название и кнопка с ценой. Настроек голосов в панели нет — разметка идёт в самом тексте.
УвеличитьШаг 3. Разметьте реплики
Пишите диалог так, как он выглядел бы в сценарии: кто говорит и что.
Ведущий: Добрый день! Сегодня разбираем, как собрать заказ за десять минут. Гость: Спасибо, что позвали. Начну с главного — с чего вообще начинать. Ведущий: Давайте по шагам.Что помогает получить нормальный разговор:
- имена перед репликами — так модель различает говорящих;
- держите роли постоянными — не меняйте «Ведущий» на «Автор» посередине;
- двух голосов достаточно — чем больше ролей, тем выше шанс, что они начнут звучать одинаково;
- короткие реплики звучат живее длинных монологов.
Здесь списываются деньги: от 5 ₽ за генерацию.
УвеличитьШаг 4. Проверьте, что голоса разошлись
Прослушайте результат целиком. Главное, на что смотреть: действительно ли голоса разные и не перепутались ли роли к середине.
Если голоса слились, попробуйте:
- сделать реплики контрастнее по длине и характеру;
- явно назвать роли по-разному: не «Первый» и «Второй», а «Ведущий» и «Гость»;
- сократить диалог и собрать длинный разговор из нескольких кусков.
Шаг 5. Когда лучше взять Диктора
Диалог нужен не всегда. Если текст читает один человек — берите Диктора: он дешевле и предсказуемее.
Диалог оправдан там, где разговор — суть материала: подкаст, сценка, интервью, обучающий ролик с вопросами и ответами.
Что дальше
Если нужно управлять интонацией и паузами — у Gemini TTS для этого есть теги стиля.
Для фоновой музыки под разговор — Suno.
Частые вопросы
Как назначить конкретный голос роли?
Прямой настройки нет: голоса модель подбирает сама. Влиять можно только разметкой реплик.
Сколько стоит?
От 5 ₽ за генерацию — на рубль дороже одиночной озвучки.
Можно ли собрать длинный подкаст?
Лучше по частям: несколько коротких генераций проще проверять и переделывать, чем один длинный файл.
