most-AI.com

Кадр

Голос и музыка

Стиль и эмоции в озвучке

Маша Семёнова5 шагов3 мин

Сверено с интерфейсом

Что понадобится:
Аккаунт Most AI, баланс и текст
Сколько стоит:
От 4 ₽ за генерацию — столько же, сколько обычная озвучка

У остальных аудиомоделей интонацию задать нечем: что написано, то и прочитано. У Gemini 3.1 TTS (Диктор) есть теги — короткие пометки прямо в тексте, которые меняют подачу.

Стоит столько же, сколько обычная озвучка: от 4 ₽.

  1. Шаг 1. Выберите Gemini TTS на вкладке «Аудио»

    Наведите курсор на вкладку «Аудио» и выберите Gemini 3.1 TTS (Диктор). В описании сказано: «Озвучка от Google с управлением стилем и эмоциями».

    Панель справа, как у всех аудиомоделей, пустая — название и кнопка с ценой.

    Правая панель НейроСтудии с моделью Gemini 3.1 TTS, обведена целиком: название модели и кнопка запуска с ценойУвеличить
  2. Шаг 2. Прочитайте подсказку в поле — там список тегов

    Подсказка у поля ввода необычно щедрая, она сразу называет теги:

    Введите текст для озвучки. Можно использовать теги: [excitedly], [whispering], [sigh], [short pause]

    Что они значат:

    • [excitedly] — воодушевлённо, с подъёмом;
    • [whispering] — шёпотом;
    • [sigh] — вздох;
    • [short pause] — короткая пауза.

    Многоточие в подсказке означает, что теги этим не исчерпываются — набор шире, и имеет смысл пробовать другие английские слова того же рода.

    Нижняя часть экрана: строка ввода с плашкой Gemini 3.1 TTS и строка со стоимостью одной генерации, обведена строка со стоимостьюУвеличить
  3. Шаг 3. Расставьте теги в тексте

    Тег ставится перед той частью, к которой относится:

    [excitedly] Друзья, у меня отличные новости!
    [short pause]
    [whispering] Только пока никому не говорите.
    [sigh] Ладно, расскажу всё сразу.
    

    Правила простые:

    • теги пишутся по-английски, в квадратных скобках, даже если текст русский;
    • тег действует вперёд, на следующий фрагмент;
    • не ставьте два тега подряд к одной фразе — модель выберет один;
    • сам текст произносится на русском, теги вслух не читаются.
  4. Шаг 4. Не переусердствуйте

    Частая ошибка — размечать каждое предложение. Получается актёрская истерика: голос дёргается от эмоции к эмоции, и слушать это тяжело.

    Рабочая мера — один-два тега на абзац, в тех местах, где смена интонации осмысленна: начало, поворот, вывод.

    Паузы — исключение, их можно ставить чаще: [short pause] хорошо разделяет пункты списка и делает речь спокойнее.

  5. Шаг 5. Сравните с ElevenLabs

    Обе модели стоят от 4 ₽, и выбор между ними такой:

    Что нужно Модель
    Просто прочитать текст ровно ElevenLabs Диктор
    Управлять интонацией и паузами Gemini TTS
    Разговор нескольких голосов ElevenLabs Диалог

    Если сомневаетесь — начните с Gemini TTS без тегов. Получится обычная озвучка, а теги можно добавить во второй попытке.

Что дальше

Раздел про голос и музыку пройден: озвучка, диалог, песня и теги.

Приёмы и примеры — в блоге: шпаргалка по голосу и аудио.

Частые вопросы

Тег не сработал

Возможно, такого тега модель не знает. Замените его на один из перечисленных в подсказке — они точно поддерживаются.

Дороже ли это обычной озвучки?

Нет, от 4 ₽ — столько же, сколько ElevenLabs Диктор.

Можно ли задать конкретный голос?

Настройки голоса в панели нет. Управление идёт только через текст и теги.

Не получилось?

Если на каком-то шаге всё пошло не так или экран выглядит иначе — напишите нам. Расскажите, на каком шаге застряли; поможем разобраться и поправим гайд.

Не пользуетесь чатом — напишите на contact@most-ai.com.