Голосовой бот в поддержке: как посчитать нагрузку и экономию
Денис Коростелёв9 мин

Зачем поддержке голос, а не просто текст
Голосовой ответ бота — это не про моду. В части каналов текст физически не работает: телефонная линия, голосовое меню, звонок «перезвоните мне», аудиосообщение в мессенджере, куда клиент надиктовал вопрос и ждёт такой же ответ. В этих сценариях оператор тратит минуты на то, что укладывается в один типовой шаблон: «статус заказа», «как вернуть товар», «режим работы», «куда прислать документы». Именно такие повторяющиеся обращения и есть кандидаты на автоматизацию голосом.
Но прежде чем внедрять голосового AI-бота, любой руководитель поддержки задаёт два вопроса: сколько обращений он реально снимет и сколько это будет стоить в месяц. На глаз тут ошибиться легко в обе стороны. Ниже — методология расчёта, которую можно повторить на своих числах. Все цифры в примере условные: подставьте вместо них статистику из своей CRM, и формула даст ответ по вашей команде.
Шаг 1. Померить текущую нагрузку
Считать экономию, не зная нагрузки, бессмысленно. Первый шаг — выгрузить из системы тикетов данные за месяц и разложить их по трём осям.
Первая ось — объём. Сколько всего обращений в месяц приходит в те каналы, где голос уместен (телефон, голосовые сообщения, автоответчик).
Вторая ось — темы. Сгруппируйте обращения по причинам. Обычно 20–30 формулировок покрывают львиную долю потока, а хвост из редких нестандартных вопросов остаётся людям.
Третья ось — время. Среднее время обработки одного обращения оператором, от снятия до закрытия, включая паузы и оформление.
Допустим, выгрузка показала условные 8000 обращений в месяц в голосовых каналах, среднее время обработки — 6 минут, а средняя стоимость минуты работы оператора (зарплата, налоги, рабочее место, руководитель, поделённые на оплаченные минуты) — 12 рублей. Тогда голосовая поддержка обходится команде примерно в 8000 × 6 × 12 = 576 000 рублей в месяц. Это база, от которой мы будем считать экономию. Ваши числа будут другими — важен сам порядок действий.
Шаг 2. Отделить шаблонное от сложного
Голосовой бот не заменит поддержку целиком, и обещать это себе — главная ошибка планирования. Он берёт на себя ровно ту часть потока, которая укладывается в предсказуемый ответ: справочные вопросы, статусы, инструкции, часы работы, типовые условия.
Вернитесь к группировке из шага 1 и честно отметьте, какие темы можно закрыть заранее подготовленным ответом без доступа к личным данным клиента или с безопасным доступом только для чтения. Всё, что требует решения по ситуации, спора, эмоций или денег, оставляйте людям — это не экономия, а риск.
Возьмём осторожную оценку: из 8000 обращений под шаблонный голосовой ответ уверенно подходят условные 45%, то есть 3600 обращений. Именно на этих 3600 бот и будет работать. Оставшиеся 4400 по-прежнему идут к операторам — но уже без очереди из типовых вопросов, а значит быстрее.
Шаг 3. Посчитать себестоимость одного голосового ответа
Один автоматический голосовой ответ состоит из двух операций, и считать их надо раздельно.
Первая — сформировать текст ответа. Это работа текстовой модели: она разбирает вопрос клиента и подставляет нужный шаблон или собирает ответ из базы знаний. В каталоге Most AI лёгкие текстовые модели стоят копейки: GPT-5.4 Mini — 0,13 ₽ за запрос (вход) и 0,76 ₽ за ответ (выход) за 1000 токенов, Gemini 2.5 Flash — 0,05 ₽ (вход) и 0,42 ₽ (выход) за 1000 токенов, Claude Haiku 4.5 — 0,17 ₽ (вход) и 0,84 ₽ (выход) за 1000 токенов. Для справочных ответов их с запасом хватает: тут не нужен самый мощный ум, нужен предсказуемый и быстрый. Цены указаны на дату публикации; актуальные — на странице цен Most AI.
Вторая операция — озвучить готовый текст. Это синтез речи (TTS). Стоимость синтеза зависит от длины ответа: чем длиннее фраза, тем дороже. Поэтому короткие, по делу сформулированные ответы экономят не только время клиента, но и бюджет. Подходящие движки в каталоге — ElevenLabs V3 с режимами «Диктор» (от 4 ₽ за генерацию) и «Диалог» (от 5 ₽ за генерацию) и Gemini 3.1 Flash TTS в режиме «Диктор» (от 4 ₽ за генерацию). Оба доступны в разделе Генерация голоса.
Методология себестоимости простая. Возьмите десяток реальных шаблонных ответов, прогоните каждый через связку «текстовая модель + синтез», зафиксируйте фактическую стоимость ответа в рублях по тарифу из раздела Цены. Не оценивайте на глаз — замерьте на своих же типовых репликах, потому что средняя длина ответа у каждой команды своя. Полученную среднюю цену одного ответа умножьте на 3600 обращений из шага 2 — это ваш месячный расход на автоматизированную часть.
Ключевая особенность модели оплаты в Most AI: платите по факту использования, без месячной подписки. Не воспользовались ботом в тихий день — не заплатили за простой. Для сезонного бизнеса, где нагрузка скачет, это принципиально: счёт следует за реальным потоком обращений, а не за абонемент «на всякий случай».
Шаг 4. Свести экономию в одну формулу
Теперь у нас есть все слагаемые. Экономия за месяц считается так:
Экономия = (обращения, ушедшие боту × стоимость обработки человеком) − (обращения, ушедшие боту × себестоимость голосового ответа).
Подставим условные числа. Раньше 3600 шаблонных обращений стоили 3600 × 6 × 12 = 259 200 рублей операторского времени. Автоматическая обработка тех же 3600 обращений через связку «текст + синтез» — это расход в рублях, который вы замерили в шаге 3. Даже при осторожной оценке разница между «минуты живого оператора» и «секунды синтеза» получается кратной, потому что вы убираете из формулы самую дорогую составляющую — человеко-минуты.
Важно не обмануть себя. В честном расчёте оставьте несколько поправок. Первая — часть звонков бот всё равно передаст оператору (клиент не понял, вопрос оказался сложнее): заложите долю эскалаций, скажем 10–15%. Вторая — разовые затраты на подготовку: написать промты, собрать базу типовых ответов, записать и утвердить голос. Это единовременная работа, которая размазывается на все последующие месяцы. Третья — то, что не оцифровывается сразу: сокращение очереди и времени ожидания, а значит меньше брошенных обращений и выше удовлетворённость. Эту выгоду не ставьте в таблицу как рубли, но держите в уме.
Как собрать пилот, не привлекая разработчиков
Хорошая новость: чтобы проверить методологию на практике, необязательно сразу строить интеграцию. Пилот собирается вручную за пару дней.
Возьмите 20–30 самых частых вопросов из шага 1. Для каждого напишите короткий, разговорный ответ — так, как сказал бы вежливый оператор, без канцелярита. Прогоните тексты через раздел генерации голоса, подберите один голос, который звучит спокойно и не устаёт от повторов, и сохраните готовые аудиоответы. Уже на этом этапе видно две вещи: реально ли ответы звучат по-человечески и сколько рублей уходит на озвучку типовой реплики. Это и есть замер для шага 3, только вживую.
Когда пилот подтвердил цифры, дальше два пути. Простой — держать библиотеку готовых аудиоответов и отдавать их вручную или полуавтоматически на частые вопросы. Полноценный — подключить синтез через API и встроить в свой контур. А общую логику — что отдавать боту, а что людям — мы подробно разложили в статье про автоматизацию ответа клиентам.
Оба движка синтеза, тексты для ответов и замер расхода живут в одном рабочем пространстве Most AI — в Студии, без VPN и с оплатой в рублях. Это удобно для пилота: не нужно собирать зоопарк из зарубежных сервисов и придумывать, как за них платить.
Что в итоге даёт методология
Голосовой бот в поддержке — не волшебная кнопка «уволить половину смены», а инструмент, который снимает с людей самый скучный и повторяющийся пласт работы. Ценность методологии в том, что она превращает интуицию «наверное, сэкономим» в четыре проверяемые цифры: объём потока, доля шаблонных обращений, себестоимость одного ответа и итоговая экономия с поправками.
Собранный на этих цифрах пилот стоит недорого, считается за выходные и даёт руководителю поддержки главное — не эмоцию, а таблицу, с которой можно идти к бюджету. А оплата по факту в Most AI означает, что даже если пилот покажет скромный эффект, вы не остались с годовой подпиской за сервис, которым почти не пользуетесь.
Частые вопросы
Голосовой бот полностью заменит операторов?
Нет, и не должен. Он берёт на себя шаблонные справочные обращения — статусы, инструкции, часы работы, типовые условия. Всё, что требует решения по ситуации, эмоций или денег, остаётся людям. Цель — снять с операторов рутину, а не сократить команду вслепую.
С чего начать расчёт, если нет аналитики по обращениям?
Начните с ручной выборки: возьмите обращения за одну–две недели, разложите по темам и прикиньте среднее время обработки. Даже грубая выгрузка даёт основу для шагов 1 и 2. Точность вырастет позже, когда накопите статистику по реальной работе бота.
Какую модель брать для текста ответа?
Для справочных ответов не нужен самый мощный ум — нужен быстрый и предсказуемый. В каталоге Most AI подойдут лёгкие модели: GPT-5.4 Mini (0,13 ₽ вход / 0,76 ₽ выход за 1000 токенов) или Gemini 2.5 Flash (0,05 ₽ / 0,42 ₽ за 1000 токенов), Claude Haiku 4.5 (0,17 ₽ / 0,84 ₽ за 1000 токенов). Мощные модели приберегите для сложных диалогов и эскалаций.
Чем ElevenLabs отличается от Gemini TTS для этой задачи?
ElevenLabs V3 даёт живой, естественный голос с режимами «Диктор» и «Диалог» — хорош, когда важна теплота интонации. Gemini 3.1 Flash TTS в режиме «Диктор» — быстрый вариант для потоковых справочных ответов. Прогоните оба на своих репликах и сравните звучание и расход.
Как понять, что бот действительно экономит, а не создаёт проблемы?
Следите за долей эскалаций — сколько обращений бот передал живому оператору. Если она растёт, значит шаблоны не покрывают реальные вопросы, и экономия иллюзорна. Здоровый пилот снижает очередь и держит эскалации в пределах заложенных 10–15%.
Сколько стоит попробовать без обязательств?
В Most AI оплата идёт по факту использования, без месячной подписки. Пилот из 20–30 озвученных ответов стоит ровно столько рублей, сколько потратили на генерацию. Не подошло — вы не остались с годовым абонементом за неиспользуемый сервис.
Озвучьте свою фразу сейчас
Вставьте текст в генератор голоса и подберите подачу — диктора или диалог. Не понравилось — перегенерируйте абзац, а не весь ролик.



