most-AI.com

Кадр

Голос и музыка

Стиль и эмоции в озвучке

Маша Семёнова6 шагов4 мин

Сверено с интерфейсом

Что понадобится:
Аккаунт Most AI, баланс и текст
Сколько стоит:
4 ₽ за генерацию — столько же, сколько обычная озвучка

У Gemini 3.1 TTS (Диктор) интонацией можно управлять двумя способами сразу: настройками голоса в форме и тегами прямо в тексте. Теги — короткие пометки в квадратных скобках, которые меняют подачу конкретной фразы.

Стоит столько же, сколько обычная озвучка: 4 ₽ за генерацию.

  1. Шаг 1. Выберите Gemini TTS на вкладке «Аудио»

    Наведите курсор на вкладку «Аудио» и выберите Gemini 3.1 TTS (Диктор). В описании сказано: «Озвучка от Google с управлением стилем и эмоциями».

    Панель справа, как у всех аудиомоделей, пустая — название и кнопка с ценой. Настройки при этом есть, просто они не там: форма модели дорисована в конце ленты генераций, в центре экрана.

    Правая панель НейроСтудии с моделью Gemini 3.1 TTS, обведена целиком: название модели и кнопка запуска с ценойУвеличить
  2. Шаг 2. Разберитесь в форме под лентой

    Промотайте ленту вниз. Над полем ввода стоят три элемента:

    • «Голос» — выпадающий список, по умолчанию Kore с пометкой «Уверенный»: у голосов есть характер, и он подписан рядом с именем;
    • «Язык» — по умолчанию русский;
    • «Стиль голоса» — отдельная кнопка рядом с голосом.

    Под полем — свёрнутый раздел «Расширенные настройки» (раскрывается нажатием) и кнопка «Сгенерировать». У самого поля есть лимит: счётчик показывает 0 / 4000.

    Форма модели под лентой генераций, обведена целиком: выбор голоса Kore, язык, кнопка «Стиль голоса», поле для текста с подсказкой про теги и раздел «Расширенные настройки»Увеличить
  3. Шаг 3. Прочитайте подсказку в поле — там список тегов

    Подсказка у поля ввода необычно щедрая, она сразу называет теги:

    Введите текст для озвучки. Можно использовать теги: [excitedly], [whispering], [sigh], [short pause]

    Что они значат:

    • [excitedly] — воодушевлённо, с подъёмом;
    • [whispering] — шёпотом;
    • [sigh] — вздох;
    • [short pause] — короткая пауза.

    Многоточие в подсказке означает, что теги этим не исчерпываются — набор шире, и имеет смысл пробовать другие английские слова того же рода.

    Здесь списываются деньги: 4 ₽ за генерацию. Цена стоит на кнопке справа и строкой внизу экрана.

    Нижняя часть экрана: строка ввода с плашкой Gemini 3.1 TTS и строка со стоимостью одной генерации, обведена строка со стоимостьюУвеличить
  4. Шаг 4. Расставьте теги в тексте

    Тег ставится перед той частью, к которой относится:

    [excitedly] Друзья, у меня отличные новости!
    [short pause]
    [whispering] Только пока никому не говорите.
    [sigh] Ладно, расскажу всё сразу.
    

    Правила простые:

    • теги пишутся по-английски, в квадратных скобках, даже если текст русский;
    • тег действует вперёд, на следующий фрагмент;
    • не ставьте два тега подряд к одной фразе — модель выберет один;
    • сам текст произносится на русском, теги вслух не читаются.
  5. Шаг 5. Не переусердствуйте

    Частая ошибка — размечать каждое предложение. Получается актёрская истерика: голос дёргается от эмоции к эмоции, и слушать это тяжело.

    Рабочая мера — один-два тега на абзац, в тех местах, где смена интонации осмысленна: начало, поворот, вывод.

    Паузы — исключение, их можно ставить чаще: [short pause] хорошо разделяет пункты списка и делает речь спокойнее.

    Если общая подача не та, сначала смените голос: у каждого свой характер, и это влияет сильнее любых тегов.

  6. Шаг 6. Сравните с ElevenLabs

    Обе модели стоят 4 ₽, и выбор между ними такой:

    Что нужно Модель
    Тонко настроить подачу ползунками ElevenLabs Диктор
    Управлять интонацией по фразам, тегами Gemini TTS
    Разговор нескольких голосов ElevenLabs Диалог

    Если сомневаетесь — начните с Gemini TTS без тегов. Получится обычная озвучка, а теги можно добавить во второй попытке.

Что дальше

Раздел про голос и музыку пройден: озвучка, диалог, песня и теги.

Приёмы и примеры — в блоге: шпаргалка по голосу и аудио.

Частые вопросы

Можно ли задать конкретный голос?

Да. В форме под лентой есть список «Голос» — по умолчанию Kore. Рядом с именем подписан характер голоса, а соседняя кнопка «Стиль голоса» даёт задать подачу отдельно от тегов.

Тег не сработал

Возможно, такого тега модель не знает. Замените его на один из перечисленных в подсказке — они точно поддерживаются.

Сколько текста помещается?

До 4000 знаков за раз — счётчик показан под полем ввода.

Дороже ли это обычной озвучки?

Нет, 4 ₽ — столько же, сколько ElevenLabs Диктор.

Что в «Расширенных настройках»?

Раздел свёрнут по умолчанию и раскрывается нажатием — загляните туда, если базовых настроек не хватило.

Не получилось?

Если на каком-то шаге всё пошло не так или экран выглядит иначе — напишите нам. Расскажите, на каком шаге застряли; поможем разобраться и поправим гайд.

Не пользуетесь чатом — напишите на contact@most-ai.com.