Цена одного ответа: восемь моделей в одном списке
В FatherGPT баланс общий на все 26 нейросетей, а списывается за каждую генерацию по её тарифу. Для текстового чата доступно восемь моделей, и вот их цена в токенах за ответ:
- DeepSeek V4 Flash — 2 токена
- GPT-5.6 Luna от OpenAI — 2 токена
- GPT-5.6 Terra от OpenAI — 16 токенов
- Grok 4.3 от xAI — 20 токенов
- Gemini 3.1 Pro от Google — 30 токенов
- GPT-5.6 Sol от OpenAI — 76 токенов
- Claude Sonnet 5 от Anthropic — 28 токенов
- Claude Opus 5 от Anthropic — 65 токенов
Между крайними точками — 32-кратная разница. Это не разница в качестве в 32 раза; так устроено ценообразование самих провайдеров, у которых мы берём модели по API. Дальше вопрос ровно один: на каких задачах вы эту разницу увидите глазами, а на каких она уйдёт в никуда.
Сколько ответов выходит из пакета: считаем
Абстрактные «токены» превращаются в понятные вещи, когда их поделить. Недельный тариф — 399 ₽ и 4 500 токенов. Если тратить весь пакет на одну модель, выходит:
- DeepSeek V4 Flash, 2 токена — 2 250 ответов за неделю. Это 321 ответ в день, упереться в такое сложно.
- GPT-5.6 Luna, 2 токена — те же 2 250 ответов, около 321 в день.
- GPT-5.6 Terra, 16 токенов — 281 ответ, 40 в день.
- Grok 4.3, 20 токенов — 225 ответов, 32 в день.
- Claude Sonnet 5, 28 токенов — 160 ответов, 22 в день.
- Gemini 3.1 Pro, 30 токенов — 150 ответов, 21 в день.
- Claude Opus 5, 65 токенов — 69 ответов, 9 в день.
- GPT-5.6 Sol, 76 токенов — 59 ответов, 8 в день.
Месячный пакет за 999 ₽ — это 12 000 токенов, то есть 6 000 ответов DeepSeek V4 Flash, 750 ответов GPT-5.6 Terra, 428 ответов Claude Sonnet 5, 400 ответов Gemini 3.1 Pro, 184 ответа Claude Opus 5 или 157 ответов GPT-5.6 Sol. Год за 8 990 ₽ даёт 90 000 токенов: 5 625 ответов на GPT-5.6 Terra или 1 384 на Claude Opus 5.
Теперь посмотрите на свой реальный ритм. Девять ответов Opus в день — это мало для человека, который живёт в чате, и много для того, кто заходит за помощью пару раз. Сорок ответов GPT-5.6 Terra в день не выберет почти никто. Отсюда простой вывод: пакет ограничивает не «сколько раз вы спросите», а «в какой пропорции вы мешаете дорогое с дешёвым».
Токены не накапливаются: неиспользованное сгорает в конце периода, а не переносится. Смысла экономить «на потом» нет — есть смысл не тратить дорогую модель там, где хватает дешёвой. Разбор списаний — в справке как работают токены, цены пакетов — на странице тарифов.
Где дешёвая модель не хуже дорогой
Есть класс задач, где потолок качества упирается не в модель, а в саму задачу. Ответ либо правильный, либо нет, и «более умная» модель не сделает его правильнее. Здесь переплата бессмысленна:
- Перевод бытовых и деловых текстов. Письмо, описание товара, переписка с поставщиком — быстрый перевод на GPT-5.6 Luna за 2 токена читается так же, как за 40.
- Пересказ и сжатие. «Сократи вдвое», «сделай список из этого абзаца» — механическая работа.
- Правка орфографии, пунктуации, канцелярита.
- Типовые тексты по шаблону: описания товаров, объявления на Авито, ответы клиентам, посты для соцсетей. Здесь ценность в скорости и объёме, а не в глубине, и GPT-5.6 Terra за 16 токенов закрывает поток целиком.
- Короткие фактические вопросы — с обязательной перепроверкой чисел: дорогая модель врёт в них не сильно реже.
- Технические мелочи: регулярные выражения, SQL-запросы, отладка чужого скрипта — DeepSeek V4 Flash за 2 токена закрывает большую часть.
Практическое правило: если вы способны за десять секунд посмотреть на ответ и сказать «верно / неверно», берите дешёвую модель. Проверяемый результат не требует дорогой.
Где разница видна и переплата окупается
Обратная сторона: задачи, где нет одного правильного ответа, зато есть длинная цепочка рассуждений и куча условий, которые нельзя терять по дороге. Здесь дешёвая модель ломается заметно.
- Длинный связный текст, который надо удержать целиком: статья, глава, сценарий, сторителлинг. Дешёвая модель к середине теряет линию и начинает повторяться.
- Работа с большим документом: анализ отчёта, техническая документация, разбор договора.
- Код сложнее сниппета: архитектура, рефакторинг, разбор незнакомой кодовой базы.
- Задачи, где нужно взвесить варианты и не соврать себе: позиционирование, брейншторм, научная работа.
- Тексты, которые пойдут наружу от вашего имени: коммерческое предложение, резюме, рекламные объявления.
Разница здесь не в «умности» одним словом, а в том, сколько условий модель удерживает одновременно и насколько аккуратно следует запретам. Попросите «без слова «инновационный», без восклицательных знаков, ровно 4 абзаца» — дешёвая нарушит один-два пункта из трёх, дорогая обычно выполнит все.
Характер моделей: чем они отличаются между собой
При сопоставимой цене модели ведут себя по-разному, и это не маркетинг, а заметная в работе вещь.
GPT-5.6 Sol и GPT-5.6 Terra от OpenAI
Ровный универсал. Хорошо держит формат, редко уходит в сторону от инструкции, предсказуемо пишет по-русски. Если не хочется выбирать — Terra за 16 токенов закрывает большинство ежедневных задач, а старшая версия за 76 берётся под длинные статьи, презентации и планирование проекта.
Claude Sonnet 5 и Opus 5 от Anthropic
Сильнее в длинных рассуждениях и аккуратнее с чужим текстом: вычитка и рерайт выходят бережнее, авторская интонация не стирается. Разница Sonnet и Opus — 28 против 65 токенов, и она заметна только на действительно сложных задачах. Сравнение с GPT — в разборе ChatGPT против Claude, а по коду — Claude против ChatGPT для кода.
Gemini 3.1 Pro от Google
Длинный контекст. Профильные задачи — анализ документов, таблицы, конспекты, перевод многостраничных файлов. 30 токенов за ответ. Подробное сопоставление — Claude против Gemini и ChatGPT против Gemini.
Grok 4.3 от xAI и DeepSeek V4 Flash
Grok за 20 токенов держит связь с актуальной повесткой: мониторинг новостей, анализ конкурентов, разбор свежих отзывов. DeepSeek V4 Flash за 2 токена — рабочая лошадь для математики и скриптов, где ответ проверяется запуском. Чем он отличается от старших моделей, разобрано в сравнении ChatGPT против DeepSeek.
Рабочая стратегия: черновик дешёвым, доводка дорогим
Схема, которая экономит больше всего при том же результате. Черновики, варианты, перебор идей — на дешёвой модели. Финальная доводка того единственного варианта, который пойдёт в дело, — на дорогой.
- Сформулируйте задачу и попросите GPT-5.6 Luna или DeepSeek V4 Flash дать 10 вариантов подхода. Цена: 2 токена у любой из них.
- Выберите один. Попросите ту же дешёвую модель развернуть его в черновик. Ещё 2 токена.
- Отдайте черновик Claude Sonnet 5 или GPT-5.6 Sol с инструкцией «перепиши, сохрани структуру, убери повторы, приведи к деловому тону». 28 или 76 токенов.
- Итог — около 32 токенов вместо 195–228, если гонять все три круга на дорогой модели. Из недельного пакета таких циклов выходит под полтораста.
Вторая привычка — проверять факты второй моделью. Спросили у дорогой, скопировали ответ, спросили у DeepSeek V4 Flash «найди в этом тексте утверждения, которые могут быть неверны». Два токена за страховку от выдуманной цифры — лучшая сделка в этом списке. Про то, почему модели выдумывают, — в статье чат с нейросетью: с чего начать.
Как выбрать за минуту
Короткий алгоритм, если читать всё выше некогда:
- Ответ можно мгновенно проверить на «верно / неверно» → DeepSeek V4 Flash или GPT-5.6 Luna.
- Типовой текст среднего объёма, каких вы делаете десятки → GPT-5.6 Terra.
- Нужны свежие данные и события → Grok 4.
- Большой документ, таблица, отчёт → Gemini 3.1 Pro, отдельный разбор — нейросеть для документов.
- Текст пойдёт наружу от вашего имени → GPT-5.6 Sol или Claude Sonnet 5.
- Сложное рассуждение, юридический или технический разбор, код архитектурного уровня → Claude Opus 5, помня про 69 ответов из недельного пакета.
Универсального чемпиона нет: подборки лучшая модель для кода, для копирайтинга и для документов собраны именно потому, что в каждой категории первое место занимает разная модель. Общий разбор критериев — в справке как выбрать модель. Самый дешёвый способ решить спор — пробный день за 1 ₽ и 300 токенов: на своей задаче разница между 12 и 65 токенами становится очевидной за полчаса.
Частые вопросы
Нет. Если ответ можно за десять секунд проверить на «верно или неверно» — перевод, пересказ, правка орфографии, короткий скрипт, — разницы вы не увидите. Проверяемый результат не требует дорогой модели.
На длинном связном тексте, который надо удержать целиком, на разборе большого документа, на коде сложнее сниппета и на текстах, которые пойдут наружу от вашего имени. Дешёвая модель чаще нарушает часть заданных ограничений.
Черновики, варианты и перебор идей делать на дешёвой модели, а доводить до чистовой — на дорогой. Второй приём — просить вторую, дешёвую модель найти в готовом ответе утверждения, которые могут быть неверны.
Да, остаток не переносится на следующий период. Пакет ограничивает не то, сколько раз вы спросите, а в какой пропорции вы мешаете дорогие модели с дешёвыми.
Попробуйте сами
Все нейросети из статьи доступны в одной подписке FatherGPT — без VPN, на русском, с оплатой картой РФ. Первый день стоит 1 ₽, чтобы спокойно всё проверить.