most-AI.com

ChatGPT, Claude, Gemini или DeepSeek: какую модель брать под какую задачу

Денис Коростелёв7 мин

Вопрос «какая нейросеть лучше» не имеет ответа, и это не уклончивость. Текстовые модели давно разошлись по специализациям: та, что лучше пишет код, необязательно лучше редактирует текст, а самая умная почти всегда самая дорогая и самая медленная.

Правильный вопрос звучит иначе: какую модель поставить на конкретную задачу, чтобы не переплачивать за то, что вам не нужно.

Сначала про стоимость

В Most AI стоимость запроса измеряется в кредитах, и разброс внутри одного семейства больше, чем между семействами. Вот как это выглядит на актуальном каталоге:

Модель Кредитов за запрос
GPT-5.4 Mini, Gemini 3.1 Flash Lite, Grok 4.3, DeepSeek V4 Pro, Kimi K2.6, GLM 5.2 1
Claude Haiku 4.5 2
GPT-5.1, GPT-5, Gemini 3.5 Flash, Gemini 2.5 Pro 3
GPT-5.4, GPT-5.2, Gemini 3.1 Pro Preview 4
Claude Sonnet 4.6, Perplexity Sonar Pro 5
Claude Opus 4.8, Claude Opus 4.6 8
GPT-5.5 9

Разница между верхом и низом таблицы — девятикратная. Если вы гоняете флагман на задачах вроде «перепиши это письмо вежливее», вы платите в девять раз больше за результат, который не отличите вслепую.

Отсюда первое практическое правило: флагман — для сложного, лёгкая модель — для рутины. Переключить модель в интерфейсе занимает секунду, а на месяце работы разница накапливается заметная.

Четыре семейства и их характеры

ChatGPT

Самая широкая линейка: от GPT-5.4 Mini за один кредит до GPT-5.5 за девять. Сильная сторона — универсальность: модель одинаково прилично справляется с текстом, рассуждением, кодом и разбором данных, не проваливаясь ни в одной категории.

Отдельно стоит GPT-5.1-Codex — версия, заточенная под работу с кодом.

Брать, когда: задача смешанная или вы не хотите думать, какую модель выбрать. Это разумный вариант по умолчанию.

Claude

Три уровня: Haiku 4.5 (2 кредита), Sonnet 4.6 (5) и Opus 4.8 (8). Семейство традиционно сильно на длинных текстах и на аккуратной работе с формулировками — там, где важно не потерять смысл при переписывании и удержать в голове весь документ целиком.

Брать, когда: нужно отредактировать большой текст, разобрать договор, переписать документ, не сломав его логику. Или когда важен тон: Claude лучше многих держит заданный стиль на протяжении длинного ответа.

Gemini

Gemini 3.1 Flash Lite за один кредит — один из самых дешёвых способов автоматизировать рутину. Gemini 3.5 Flash (3) и Gemini 3.1 Pro Preview (4) — рабочая середина.

Сильная сторона линейки — скорость и работа с большими объёмами входных данных.

Брать, когда: нужно быстро обработать много однотипных запросов или разобрать длинный материал, где важнее охват, чем изящество формулировок.

DeepSeek, Kimi, GLM, Grok

Четыре модели по одному кредиту, и это отдельная категория — «дёшево и достаточно». DeepSeek V4 Pro заметно силён в рассуждении и коде для своей цены. Kimi K2.6 и GLM 5.2 хорошо работают с длинным контекстом. Grok 4.3 быстрый и уверенно держит разговорный тон.

Брать, когда: объём запросов большой, а задача типовая. На черновиках, классификации, извлечении данных из текста разница с флагманом почти незаметна, а цена отличается в разы.

Perplexity

Sonar (1 кредит) и Sonar Pro (5) стоят особняком: это модели, заточенные под поиск с опорой на источники. Они не про «сочинить», а про «найти и сослаться».

Брать, когда: нужны свежие факты, а не рассуждение. Обычная языковая модель на вопросе «что вышло на прошлой неделе» уверенно придумает ответ; Sonar пойдёт искать.

Правило выбора на каждый день

Если не хочется каждый раз взвешивать, работает простая лестница:

  1. Рутина — переформулировать, сократить, перевести, разложить по пунктам → модель за 1 кредит.
  2. Работа с документом — большой текст, важен смысл и тон → Claude Sonnet 4.6.
  3. Свежие факты, нужны ссылки → Perplexity Sonar Pro.
  4. Сложное рассуждение, код, задача с подвохом → флагман (GPT-5.5 или Claude Opus 4.8).
  5. Не знаю, что из этого → GPT-5.4.

Девять из десяти повседневных запросов закрываются первым пунктом.

Что почти не зависит от модели

Есть вещи, которые не чинятся выбором модели, и о них честнее сказать сразу.

Выдуманные факты. Любая языковая модель подбирает правдоподобное продолжение, а не проверяет истину. Флагман ошибается реже, но ошибается тем же уверенным тоном. Ссылки, даты, цифры и цитаты проверяйте всегда — независимо от того, сколько кредитов стоил запрос.

Качество запроса. Разница между плохим и хорошим промптом больше, чем разница между самой дешёвой и самой дорогой моделью. Три элемента, которые улучшают почти любой запрос:

  • Роль и контекст: «Ты редактор. Текст пойдёт в рассылку для клиентов».
  • Формат ответа: «Три абзаца», «таблица», «список из пяти пунктов».
  • Ограничения: «Без канцелярита», «не длиннее 800 знаков», «не придумывай данные, которых нет во входном тексте».

Ваше знание предмета. Модель не знает контекста вашей компании, договорённостей с клиентом и того, что обсуждалось на прошлой встрече. Всё это нужно принести в запрос самому.

Сколько это стоит на реальной нагрузке

Абстрактные кредиты плохо помогают решать. Прикинем на типовых профилях.

Допустим, один рабочий запрос — это письмо, разбор куска текста или переформулировка. Возьмём 30 таких запросов в день.

Профиль Модель Кредитов в день В месяц
Всё на флагмане GPT-5.5 (9) 270 ~8 100
Всё на средней GPT-5.4 (4) 120 ~3 600
Всё на лёгкой Gemini 3.1 Flash Lite (1) 30 ~900
Разумный микс 25 лёгких + 5 флагман 70 ~2 100

Последняя строка — то, ради чего вообще стоит разбираться в моделях. Разумный микс дешевле сплошного флагмана вчетверо, а разница в результате видна только на тех пяти запросах, которые действительно сложные.

Практический вывод: не ищите «лучшую модель». Определите, какие ваши задачи действительно сложные, — обычно их меньше, чем кажется.

Как переключаться, не теряя контекст

Частая проблема при работе с несколькими моделями — приходится заново объяснять контекст. Два приёма:

Держите «преамбулу» отдельно. Короткий блок из трёх-четырёх предложений: кто вы, чем занимается компания, для кого текст. Вставляйте его в начало запроса при смене модели — это дешевле, чем переписка на десять сообщений.

Просите модель подытожить перед переходом. «Собери всё, о чём мы договорились, в семь пунктов» — и переносите этот итог в новый диалог. Работает лучше, чем пересказывать своими словами.

Частые вопросы

Какая модель лучше для русского языка?

Все перечисленные семейства работают с русским уверенно. Заметная разница появляется не в грамотности, а в стилистике: одни склонны к канцеляриту, другие — к разговорности. Проверяйте на своём типовом тексте.

Стоит ли всегда брать самую новую модель?

Нет. Новая версия почти всегда дороже, а выигрыш заметен только на сложных задачах. На рутине разницу вы не увидите, а счёт вырастет.

Что такое кредиты?

Внутренняя единица оплаты: у каждой модели своя стоимость запроса в кредитах. Оплата идёт по факту использования, без месячной подписки.

Можно ли пользоваться бесплатно?

Да, чат доступен без ограничения по количеству запросов. Флагманские модели — за кредиты.

Модель придумывает факты. Это лечится?

Полностью — нет, это свойство технологии. Снижается двумя способами: брать модель с поиском по источникам для фактических вопросов и проверять каждую цифру и ссылку самому.

Нужен ли VPN?

Нет. Доступ идёт через сервис, оплата в рублях.

Как сравнить самому

Не верьте сравнениям на чужих задачах, включая это. Возьмите свой типовой запрос — тот, который повторяется у вас каждую неделю, — и прогоните его через три модели: одну за кредит, одну среднюю и один флагман.

Смотрите не на «понравилось / не понравилось», а на конкретное: сколько правок пришлось внести руками, чтобы результат стал рабочим. Если у модели за 1 кредит правок на минуту больше, а стоит она в пять раз дешевле, выбор очевиден.

Каталог целиком, с типами и актуальными ценами, — в разделе нейросетей и на странице тарифов. Попробовать чат можно бесплатно и без ограничения по количеству запросов — как это устроено.

Денис Коростелёв

Продуктовый аналитик

Сравнивает модели на одинаковых промптах и считает себестоимость результата. Не верит сравнениям без методики — включая собственные.