Стиль и эмоции в озвучке
Маша Семёнова5 шагов3 мин
Сверено с интерфейсом
- Что понадобится:
- Аккаунт Most AI, баланс и текст
- Сколько стоит:
- От 4 ₽ за генерацию — столько же, сколько обычная озвучка
У остальных аудиомоделей интонацию задать нечем: что написано, то и прочитано. У Gemini 3.1 TTS (Диктор) есть теги — короткие пометки прямо в тексте, которые меняют подачу.
Стоит столько же, сколько обычная озвучка: от 4 ₽.
Шаг 1. Выберите Gemini TTS на вкладке «Аудио»
Наведите курсор на вкладку «Аудио» и выберите Gemini 3.1 TTS (Диктор). В описании сказано: «Озвучка от Google с управлением стилем и эмоциями».
Панель справа, как у всех аудиомоделей, пустая — название и кнопка с ценой.
УвеличитьШаг 2. Прочитайте подсказку в поле — там список тегов
Подсказка у поля ввода необычно щедрая, она сразу называет теги:
Введите текст для озвучки. Можно использовать теги:
[excitedly],[whispering],[sigh],[short pause]…Что они значат:
[excitedly]— воодушевлённо, с подъёмом;[whispering]— шёпотом;[sigh]— вздох;[short pause]— короткая пауза.
Многоточие в подсказке означает, что теги этим не исчерпываются — набор шире, и имеет смысл пробовать другие английские слова того же рода.
УвеличитьШаг 3. Расставьте теги в тексте
Тег ставится перед той частью, к которой относится:
[excitedly] Друзья, у меня отличные новости! [short pause] [whispering] Только пока никому не говорите. [sigh] Ладно, расскажу всё сразу.Правила простые:
- теги пишутся по-английски, в квадратных скобках, даже если текст русский;
- тег действует вперёд, на следующий фрагмент;
- не ставьте два тега подряд к одной фразе — модель выберет один;
- сам текст произносится на русском, теги вслух не читаются.
Шаг 4. Не переусердствуйте
Частая ошибка — размечать каждое предложение. Получается актёрская истерика: голос дёргается от эмоции к эмоции, и слушать это тяжело.
Рабочая мера — один-два тега на абзац, в тех местах, где смена интонации осмысленна: начало, поворот, вывод.
Паузы — исключение, их можно ставить чаще:
[short pause]хорошо разделяет пункты списка и делает речь спокойнее.Шаг 5. Сравните с ElevenLabs
Обе модели стоят от 4 ₽, и выбор между ними такой:
Что нужно Модель Просто прочитать текст ровно ElevenLabs Диктор Управлять интонацией и паузами Gemini TTS Разговор нескольких голосов ElevenLabs Диалог Если сомневаетесь — начните с Gemini TTS без тегов. Получится обычная озвучка, а теги можно добавить во второй попытке.
Что дальше
Раздел про голос и музыку пройден: озвучка, диалог, песня и теги.
Приёмы и примеры — в блоге: шпаргалка по голосу и аудио.
Частые вопросы
Тег не сработал
Возможно, такого тега модель не знает. Замените его на один из перечисленных в подсказке — они точно поддерживаются.
Дороже ли это обычной озвучки?
Нет, от 4 ₽ — столько же, сколько ElevenLabs Диктор.
Можно ли задать конкретный голос?
Настройки голоса в панели нет. Управление идёт только через текст и теги.
