Блог · Редакция FatherGPT · 7 мин · обновлено 8 августа 2026

Какую модель брать под разговор: GPT, Claude, Gemini

Разница между самой дешёвой и самой дорогой моделью в чате — в 32 раза по цене ответа. Считаем честно, что эта разница даёт на практике и на каких задачах её не видно вообще.

Цена одного ответа: восемь моделей в одном списке

В FatherGPT баланс общий на все 26 нейросетей, а списывается за каждую генерацию по её тарифу. Для текстового чата доступно восемь моделей, и вот их цена в токенах за ответ:

Между крайними точками — 32-кратная разница. Это не разница в качестве в 32 раза; так устроено ценообразование самих провайдеров, у которых мы берём модели по API. Дальше вопрос ровно один: на каких задачах вы эту разницу увидите глазами, а на каких она уйдёт в никуда.

Сколько ответов выходит из пакета: считаем

Абстрактные «токены» превращаются в понятные вещи, когда их поделить. Недельный тариф — 399 ₽ и 4 500 токенов. Если тратить весь пакет на одну модель, выходит:

  • DeepSeek V4 Flash, 2 токена — 2 250 ответов за неделю. Это 321 ответ в день, упереться в такое сложно.
  • GPT-5.6 Luna, 2 токена — те же 2 250 ответов, около 321 в день.
  • GPT-5.6 Terra, 16 токенов — 281 ответ, 40 в день.
  • Grok 4.3, 20 токенов — 225 ответов, 32 в день.
  • Claude Sonnet 5, 28 токенов — 160 ответов, 22 в день.
  • Gemini 3.1 Pro, 30 токенов — 150 ответов, 21 в день.
  • Claude Opus 5, 65 токенов — 69 ответов, 9 в день.
  • GPT-5.6 Sol, 76 токенов — 59 ответов, 8 в день.

Месячный пакет за 999 ₽ — это 12 000 токенов, то есть 6 000 ответов DeepSeek V4 Flash, 750 ответов GPT-5.6 Terra, 428 ответов Claude Sonnet 5, 400 ответов Gemini 3.1 Pro, 184 ответа Claude Opus 5 или 157 ответов GPT-5.6 Sol. Год за 8 990 ₽ даёт 90 000 токенов: 5 625 ответов на GPT-5.6 Terra или 1 384 на Claude Opus 5.

Теперь посмотрите на свой реальный ритм. Девять ответов Opus в день — это мало для человека, который живёт в чате, и много для того, кто заходит за помощью пару раз. Сорок ответов GPT-5.6 Terra в день не выберет почти никто. Отсюда простой вывод: пакет ограничивает не «сколько раз вы спросите», а «в какой пропорции вы мешаете дорогое с дешёвым».

Токены не накапливаются: неиспользованное сгорает в конце периода, а не переносится. Смысла экономить «на потом» нет — есть смысл не тратить дорогую модель там, где хватает дешёвой. Разбор списаний — в справке как работают токены, цены пакетов — на странице тарифов.

Где дешёвая модель не хуже дорогой

Есть класс задач, где потолок качества упирается не в модель, а в саму задачу. Ответ либо правильный, либо нет, и «более умная» модель не сделает его правильнее. Здесь переплата бессмысленна:

  • Перевод бытовых и деловых текстов. Письмо, описание товара, переписка с поставщиком — быстрый перевод на GPT-5.6 Luna за 2 токена читается так же, как за 40.
  • Пересказ и сжатие. «Сократи вдвое», «сделай список из этого абзаца» — механическая работа.
  • Правка орфографии, пунктуации, канцелярита.
  • Типовые тексты по шаблону: описания товаров, объявления на Авито, ответы клиентам, посты для соцсетей. Здесь ценность в скорости и объёме, а не в глубине, и GPT-5.6 Terra за 16 токенов закрывает поток целиком.
  • Короткие фактические вопросы — с обязательной перепроверкой чисел: дорогая модель врёт в них не сильно реже.
  • Технические мелочи: регулярные выражения, SQL-запросы, отладка чужого скрипта — DeepSeek V4 Flash за 2 токена закрывает большую часть.

Практическое правило: если вы способны за десять секунд посмотреть на ответ и сказать «верно / неверно», берите дешёвую модель. Проверяемый результат не требует дорогой.

Где разница видна и переплата окупается

Обратная сторона: задачи, где нет одного правильного ответа, зато есть длинная цепочка рассуждений и куча условий, которые нельзя терять по дороге. Здесь дешёвая модель ломается заметно.

  • Длинный связный текст, который надо удержать целиком: статья, глава, сценарий, сторителлинг. Дешёвая модель к середине теряет линию и начинает повторяться.
  • Работа с большим документом: анализ отчёта, техническая документация, разбор договора.
  • Код сложнее сниппета: архитектура, рефакторинг, разбор незнакомой кодовой базы.
  • Задачи, где нужно взвесить варианты и не соврать себе: позиционирование, брейншторм, научная работа.
  • Тексты, которые пойдут наружу от вашего имени: коммерческое предложение, резюме, рекламные объявления.

Разница здесь не в «умности» одним словом, а в том, сколько условий модель удерживает одновременно и насколько аккуратно следует запретам. Попросите «без слова «инновационный», без восклицательных знаков, ровно 4 абзаца» — дешёвая нарушит один-два пункта из трёх, дорогая обычно выполнит все.

Характер моделей: чем они отличаются между собой

При сопоставимой цене модели ведут себя по-разному, и это не маркетинг, а заметная в работе вещь.

GPT-5.6 Sol и GPT-5.6 Terra от OpenAI

Ровный универсал. Хорошо держит формат, редко уходит в сторону от инструкции, предсказуемо пишет по-русски. Если не хочется выбирать — Terra за 16 токенов закрывает большинство ежедневных задач, а старшая версия за 76 берётся под длинные статьи, презентации и планирование проекта.

Claude Sonnet 5 и Opus 5 от Anthropic

Сильнее в длинных рассуждениях и аккуратнее с чужим текстом: вычитка и рерайт выходят бережнее, авторская интонация не стирается. Разница Sonnet и Opus — 28 против 65 токенов, и она заметна только на действительно сложных задачах. Сравнение с GPT — в разборе ChatGPT против Claude, а по коду — Claude против ChatGPT для кода.

Gemini 3.1 Pro от Google

Длинный контекст. Профильные задачи — анализ документов, таблицы, конспекты, перевод многостраничных файлов. 30 токенов за ответ. Подробное сопоставление — Claude против Gemini и ChatGPT против Gemini.

Grok 4.3 от xAI и DeepSeek V4 Flash

Grok за 20 токенов держит связь с актуальной повесткой: мониторинг новостей, анализ конкурентов, разбор свежих отзывов. DeepSeek V4 Flash за 2 токена — рабочая лошадь для математики и скриптов, где ответ проверяется запуском. Чем он отличается от старших моделей, разобрано в сравнении ChatGPT против DeepSeek.

Рабочая стратегия: черновик дешёвым, доводка дорогим

Схема, которая экономит больше всего при том же результате. Черновики, варианты, перебор идей — на дешёвой модели. Финальная доводка того единственного варианта, который пойдёт в дело, — на дорогой.

  1. Сформулируйте задачу и попросите GPT-5.6 Luna или DeepSeek V4 Flash дать 10 вариантов подхода. Цена: 2 токена у любой из них.
  2. Выберите один. Попросите ту же дешёвую модель развернуть его в черновик. Ещё 2 токена.
  3. Отдайте черновик Claude Sonnet 5 или GPT-5.6 Sol с инструкцией «перепиши, сохрани структуру, убери повторы, приведи к деловому тону». 28 или 76 токенов.
  4. Итог — около 32 токенов вместо 195–228, если гонять все три круга на дорогой модели. Из недельного пакета таких циклов выходит под полтораста.

Вторая привычка — проверять факты второй моделью. Спросили у дорогой, скопировали ответ, спросили у DeepSeek V4 Flash «найди в этом тексте утверждения, которые могут быть неверны». Два токена за страховку от выдуманной цифры — лучшая сделка в этом списке. Про то, почему модели выдумывают, — в статье чат с нейросетью: с чего начать.

Как выбрать за минуту

Короткий алгоритм, если читать всё выше некогда:

  • Ответ можно мгновенно проверить на «верно / неверно» → DeepSeek V4 Flash или GPT-5.6 Luna.
  • Типовой текст среднего объёма, каких вы делаете десятки → GPT-5.6 Terra.
  • Нужны свежие данные и события → Grok 4.
  • Большой документ, таблица, отчёт → Gemini 3.1 Pro, отдельный разбор — нейросеть для документов.
  • Текст пойдёт наружу от вашего имени → GPT-5.6 Sol или Claude Sonnet 5.
  • Сложное рассуждение, юридический или технический разбор, код архитектурного уровня → Claude Opus 5, помня про 69 ответов из недельного пакета.

Универсального чемпиона нет: подборки лучшая модель для кода, для копирайтинга и для документов собраны именно потому, что в каждой категории первое место занимает разная модель. Общий разбор критериев — в справке как выбрать модель. Самый дешёвый способ решить спор — пробный день за 1 ₽ и 300 токенов: на своей задаче разница между 12 и 65 токенами становится очевидной за полчаса.

Частые вопросы

Нет. Если ответ можно за десять секунд проверить на «верно или неверно» — перевод, пересказ, правка орфографии, короткий скрипт, — разницы вы не увидите. Проверяемый результат не требует дорогой модели.

На длинном связном тексте, который надо удержать целиком, на разборе большого документа, на коде сложнее сниппета и на текстах, которые пойдут наружу от вашего имени. Дешёвая модель чаще нарушает часть заданных ограничений.

Черновики, варианты и перебор идей делать на дешёвой модели, а доводить до чистовой — на дорогой. Второй приём — просить вторую, дешёвую модель найти в готовом ответе утверждения, которые могут быть неверны.

Да, остаток не переносится на следующий период. Пакет ограничивает не то, сколько раз вы спросите, а в какой пропорции вы мешаете дорогие модели с дешёвыми.

Попробуйте сами

Все нейросети из статьи доступны в одной подписке FatherGPT — без VPN, на русском, с оплатой картой РФ. Первый день стоит 1 ₽, чтобы спокойно всё проверить.