Anthropic · Идеи

Claude Opus 4.8 для брейншторма: генерация и отбор идей

Брейншторм состоит из двух противоположных операций: сначала надо произвести много разного, потом безжалостно сократить. Первое умеет любая модель, второе — почти никакая, потому что по умолчанию нейросеть склонна одобрять всё, что ей показали. Opus 4.8 стоит 65 токенов за ход и держит длинную дискуссию: помнит, что вы отвергли десять реплик назад и по какой причине.

Почему Claude Opus 4.8 подходит для этой задачи

Расхождение и схождение — разные режимы мышления, и смешивать их в одном запросе разрушительно. Когда вы просите «придумай идеи и выбери лучшую», модель заранее фильтрует себя и выдаёт пять осторожных вариантов, каждый из которых можно защитить перед начальством. Развести фазы явно — сначала только генерация без единой оценки, потом только отбраковка по заданным критериям — даёт результат другого качества, и дорогая модель нужна как раз на второй фазе.

Длинная сессия — вторая причина. Настоящий брейншторм не укладывается в один обмен репликами: вы предлагаете, отвергаете, уточняете ограничение, возвращаетесь к отброшенному под новым углом. Модель, теряющая нить, начинает по третьему кругу подсовывать то, что вы уже забраковали, — и разговор превращается в вежливое хождение по кругу. Opus держит контекст обсуждения целиком, включая ваши основания для отказа.

Про цену прямо. 65 токенов за ход — самая дорогая текстовая модель набора; сессия из восьми реплик стоит 520 токенов, за месяц это два десятка полноценных обсуждений. Платить столько имеет смысл за настоящую совместную работу над плохо определённой задачей. Если вам нужны пятьдесят вариантов формулировки или список названий, это не брейншторм, а перебор — там nano за 3 токена даст больше вариантов за одну тридцатую цены.

Какие входные данные подготовить

Задача, поставленная как проблема, а не как решение: «у нас 70% новых пользователей не доходят до первого действия», а не «нужно сделать онбординг».

Настоящие ограничения: сколько денег, сколько времени, что нельзя делать по закону, договору или из соображений репутации.

Что уже пробовали и почему не сработало. Без этого первые пять идей будут ровно тем, что вы делали в прошлом году.

Критерии отбора, сформулированные заранее, до генерации. Придуманные после того, как идеи появились, они всегда подстраиваются под понравившуюся.

Кто будет это делать: два человека на полставки и подрядчик — совсем другое поле возможностей, чем отдел из десяти человек.

Пошаговый процесс

Запретите оценку в фазе генерации

Прямым текстом: только идеи, никаких комментариев о реалистичности, никакого ранжирования, повторов и объяснений. Просите двадцать пять — не десять: первые семь будут очевидными, интересное начинается после пятнадцатого, когда очевидное закончилось. Пропуск этого запрета — самая частая причина скучного результата.

Заказывайте идеи блоками по типу

Дешёвые и быстрые; дорогие и долгие; те, что делаются чужими руками; те, что противоречат вашей текущей стратегии. Последний блок обычно самый ценный: там оказываются варианты, которые вы сами себе запретили думать. Разбивка по типам мешает модели свалиться в одну колею.

Отбраковывайте, а не выбирайте

Введите критерии и попросите не «выбрать лучшее», а объяснить по каждой идее, почему она НЕ проходит. Отрицательная формулировка ломает склонность модели всё одобрять: хвалить нечего, надо искать основания для отказа. Выживших после такого прохода обычно трое-четверо, и это осмысленный шорт-лист, а не список вежливостей.

Раскопайте выживших до первого шага

По каждой оставшейся идее: что конкретно делаем на первой неделе, во что это обойдётся, как за семь дней понять, что затея не работает. Идея, у которой нет дешёвой недельной проверки, — не идея, а намерение. Этот шаг убивает ещё одну-две из трёх, и это нормально.

Проверьте на людях, а не на модели

Спрашивать у модели, хороша ли идея, бессмысленно — она согласится. Последний шаг делается снаружи: покажите двум-трём людям, которые не участвовали в обсуждении и заинтересованы возразить. Возражение, которого не было в разговоре с моделью, обычно и есть самое важное.

Пример готового промпта

Работаем в два этапа. Этап 1 — только генерация. Оценивать,
ранжировать и комментировать реалистичность запрещено.

Проблема: из тех, кто зарегистрировался в нашем сервисе, 72 процента
не делают ни одного действия и больше не возвращаются.

Что уже пробовали и не сработало: приветственное письмо (открываемость есть,
переходов нет), всплывающая подсказка на первом экране, звонок менеджера
новым пользователям (дорого, конверсия та же).

Ограничения: команда — два человека на полставки, бюджет на эксперимент
до 50 тысяч рублей, менять цены нельзя, срок на проверку гипотезы — две недели.

Дай 25 идей, разбитых на четыре блока:
- быстрые и почти бесплатные;
- требующие разработки;
- те, что делаются чужими руками (партнёры, пользователи, подрядчики);
- те, что противоречат нашему текущему подходу.

Без пояснений, одной строкой каждая, без повторов.

Этап 2 запущу отдельным сообщением: дам критерии и попрошу объяснить
по каждой идее, почему она НЕ проходит.

Блок «противоречащих нашему подходу» и предупреждение о втором этапе работают вместе: модель знает, что оценка будет позже, и не начинает фильтровать себя заранее ради того, чтобы понравиться.

Как проверить результат

Найдите в списке хотя бы одну идею, которая вам неприятна или неудобна. Если все двадцать пять приятные — модель подстроилась под вас, и генерацию надо повторить с более жёстким запретом на самоцензуру.

Проверьте каждую выжившую идею вопросом «это отличается от того, что делают все остальные в нашей нише». Совпадение с общей практикой не порок, но и не результат брейншторма.

Убедитесь, что у каждой идеи шорт-листа есть дешёвая проверка в пределах недели-двух. Если проверить можно только запуском целиком — идея не готова к решению.

Спросите отдельным запросом, при каком условии выбранная идея провалится. Ответ на «почему это не сработает» полезнее любого подтверждения того, что план хорош.

Типичные ошибки

Смешивают генерацию и оценку

Запрос «предложи идеи и оцени их» даёт пять безопасных вариантов с аккуратными оговорками — модель отфильтровала всё смелое ещё до того, как написала. Разведите фазы разными сообщениями и в первой прямо запретите любые оценки. Это одна строчка в промпте и самая большая разница в результате.

Скрывают, что уже пробовали

Не сказав про неудачные попытки, вы гарантированно получите их обратно в первой пятёрке — они же очевидные. Дальше половина обсуждения уйдёт на объяснения, почему это не подходит. Список «пробовали, не сработало по такой-то причине» экономит два-три хода по 65 токенов и сразу поднимает планку.

Принимают одобрение модели за проверку

Спросите «хорош ли мой план» — и получите развёрнутое подтверждение почти на любой план, включая плохой. Это свойство, а не сбой: модель отвечает на запрос об оценке доброжелательно. Спрашивать надо иначе — «назови три причины, по которым это провалится» и «что должно быть правдой, чтобы затея сработала». Формулировка вопроса определяет, получите вы разбор или комплимент.

Частые вопросы

Сколько стоит одна сессия брейншторма?

65 токенов за ход. Полноценное обсуждение — это шесть-десять реплик, то есть 400–650 токенов, около 4–5% месячного пакета в 12 000. Примерно двадцать серьёзных сессий в месяц, чего для реального планирования более чем достаточно.

Почему модель одобряет любую мою идею?

Потому что вопрос задан как просьба об оценке, а на такие вопросы модель отвечает доброжелательно. Меняйте формулировку на разрушающую: «назови три причины, по которым это провалится», «что должно быть правдой, чтобы это сработало», «какое возражение я не учёл». Ответы становятся принципиально другими.

Сколько идей просить за раз?

Двадцать-тридцать. На десяти вы получите только очевидное — то, что и так лежало на поверхности. Интересное начинается после пятнадцатого пункта, когда банальные ходы у модели закончились и приходится искать дальше.

Чем это отличается от нейминга на nano?

Нейминг — задача объёма: нужно много однотипных вариантов и человеческий отбор, и там правит цена за запрос. Брейншторм — задача связности: важно, чтобы модель помнила ход обсуждения, ваши отказы и ограничения. Это разные работы, и модели для них тоже разные.

Можно ли вести обсуждение с телефона?

Да, баланс токенов общий для app.fathergpt.ru и @FatherGPTBot, так что фазу генерации удобно запускать в боте по дороге, а разбор и отбраковку делать в кабинете, где виден весь список сразу.

Модель Claude Opus 4.8 доступна в FatherGPT: без VPN, картой РФ, единый баланс токенов на все нейросети. Переключайтесь между моделями в одном чате — под каждую задачу своя.