Стиль и эмоции в озвучке
Маша Семёнова6 шагов4 мин
Сверено с интерфейсом
- Что понадобится:
- Аккаунт Most AI, баланс и текст
- Сколько стоит:
- 4 ₽ за генерацию — столько же, сколько обычная озвучка
У Gemini 3.1 TTS (Диктор) интонацией можно управлять двумя способами сразу: настройками голоса в форме и тегами прямо в тексте. Теги — короткие пометки в квадратных скобках, которые меняют подачу конкретной фразы.
Стоит столько же, сколько обычная озвучка: 4 ₽ за генерацию.
Шаг 1. Выберите Gemini TTS на вкладке «Аудио»
Наведите курсор на вкладку «Аудио» и выберите Gemini 3.1 TTS (Диктор). В описании сказано: «Озвучка от Google с управлением стилем и эмоциями».
Панель справа, как у всех аудиомоделей, пустая — название и кнопка с ценой. Настройки при этом есть, просто они не там: форма модели дорисована в конце ленты генераций, в центре экрана.
УвеличитьШаг 2. Разберитесь в форме под лентой
Промотайте ленту вниз. Над полем ввода стоят три элемента:
- «Голос» — выпадающий список, по умолчанию Kore с пометкой «Уверенный»: у голосов есть характер, и он подписан рядом с именем;
- «Язык» — по умолчанию русский;
- «Стиль голоса» — отдельная кнопка рядом с голосом.
Под полем — свёрнутый раздел «Расширенные настройки» (раскрывается нажатием) и кнопка «Сгенерировать». У самого поля есть лимит: счётчик показывает 0 / 4000.
УвеличитьШаг 3. Прочитайте подсказку в поле — там список тегов
Подсказка у поля ввода необычно щедрая, она сразу называет теги:
Введите текст для озвучки. Можно использовать теги:
[excitedly],[whispering],[sigh],[short pause]…Что они значат:
[excitedly]— воодушевлённо, с подъёмом;[whispering]— шёпотом;[sigh]— вздох;[short pause]— короткая пауза.
Многоточие в подсказке означает, что теги этим не исчерпываются — набор шире, и имеет смысл пробовать другие английские слова того же рода.
Здесь списываются деньги: 4 ₽ за генерацию. Цена стоит на кнопке справа и строкой внизу экрана.
УвеличитьШаг 4. Расставьте теги в тексте
Тег ставится перед той частью, к которой относится:
[excitedly] Друзья, у меня отличные новости! [short pause] [whispering] Только пока никому не говорите. [sigh] Ладно, расскажу всё сразу.Правила простые:
- теги пишутся по-английски, в квадратных скобках, даже если текст русский;
- тег действует вперёд, на следующий фрагмент;
- не ставьте два тега подряд к одной фразе — модель выберет один;
- сам текст произносится на русском, теги вслух не читаются.
Шаг 5. Не переусердствуйте
Частая ошибка — размечать каждое предложение. Получается актёрская истерика: голос дёргается от эмоции к эмоции, и слушать это тяжело.
Рабочая мера — один-два тега на абзац, в тех местах, где смена интонации осмысленна: начало, поворот, вывод.
Паузы — исключение, их можно ставить чаще:
[short pause]хорошо разделяет пункты списка и делает речь спокойнее.Если общая подача не та, сначала смените голос: у каждого свой характер, и это влияет сильнее любых тегов.
Шаг 6. Сравните с ElevenLabs
Обе модели стоят 4 ₽, и выбор между ними такой:
Что нужно Модель Тонко настроить подачу ползунками ElevenLabs Диктор Управлять интонацией по фразам, тегами Gemini TTS Разговор нескольких голосов ElevenLabs Диалог Если сомневаетесь — начните с Gemini TTS без тегов. Получится обычная озвучка, а теги можно добавить во второй попытке.
Что дальше
Раздел про голос и музыку пройден: озвучка, диалог, песня и теги.
Приёмы и примеры — в блоге: шпаргалка по голосу и аудио.
Частые вопросы
Можно ли задать конкретный голос?
Да. В форме под лентой есть список «Голос» — по умолчанию Kore. Рядом с именем подписан характер голоса, а соседняя кнопка «Стиль голоса» даёт задать подачу отдельно от тегов.
Тег не сработал
Возможно, такого тега модель не знает. Замените его на один из перечисленных в подсказке — они точно поддерживаются.
Сколько текста помещается?
До 4000 знаков за раз — счётчик показан под полем ввода.
Дороже ли это обычной озвучки?
Нет, 4 ₽ — столько же, сколько ElevenLabs Диктор.
Что в «Расширенных настройках»?
Раздел свёрнут по умолчанию и раскрывается нажатием — загляните туда, если базовых настроек не хватило.
