Чек-лист

GPT-6 Sol против Claude Opus 5.5: выбор и проверки результата

Сравни две модели на одинаковой задаче: проверь настройки, качество готовой работы, глубину анализа и расход лимитов.

Содержание6 глав
  1. 011. Подготовь инструменты и одинаковые условия
  2. 022. Проверь игру, если задача связана с кодом и интерактивностью
  3. 033. Проверь симуляцию воронки
  4. 044. Проверь финансовый анализ и презентацию
  5. 055. Проверь лимиты перед выбором подписки
  6. 066. Распредели задачи между моделями

1. Подготовь инструменты и одинаковые условия

  • Открой GPT-6 Sol в Codex или ChatGPT Work, а Claude Opus 5.5 — в Claude. Проверь доступность нужной модели в своём аккаунте. Sol не следует искать в обычном чате ChatGPT. Ссылки: ChatGPT Work и Codex, Claude Opus.
  • Выбери задачу под свою работу: создание игры, перенос схемы в интерактивную симуляцию или финансовый анализ с презентацией. Не выбирай модель только по общему рейтингу бенчмарков.
  • Передай обеим моделям одинаковое задание и одинаковые исходные материалы. Для воронки используй одну и ту же фотографию схемы; для финансового анализа — один и тот же набор данных.
  • Сопоставь режимы рассуждения перед запуском. Условия сравнения: Ultra для сложных задач; высокий режим для финансового анализа. Не включай Ultra автоматически для любой работы.
  • Сравни первые результаты после одного промпта: время выполнения, полноту работы и объём необходимых доработок. Отдельно оцени техническую корректность и оформление.

2. Проверь игру, если задача связана с кодом и интерактивностью

  • Запусти игру и проверь, есть ли полноценное 3D, насколько проработана карта и можно ли свободно перемещаться по миру.
  • Проверь физику полёта, возможность столкновения или падения, смену погоды и качество графики. Учитывай эти детали при оценке законченности результата.
  • Сопоставь скорость генерации с полнотой реализации. Быстрое выполнение не компенсирует отсутствующие механики, если они нужны для задачи.
  • Используй количество строк кода только вместе с проверкой работающей игры. Ориентиры конкретного сравнения: 770 строк у GPT-6 Sol и 2950 строк у Claude Opus 5.5; это не требуемый объём кода для нового проекта.

3. Проверь симуляцию воронки

  • Приложи фотографию нарисованной воронки и задай цель: определить показатели, необходимые для достижения 4 млн рублей. Восстановленное задание для копирования находится ниже.
  • Сверь схему с фотографией: расположение элементов, связи и направления стрелок. Особенно внимательно проверь места, где стрелки можно прочитать неоднозначно.
  • Проверь ползунки и пересчёт показателей: изменение параметров должно позволять исследовать, какие значения нужны для достижения цели.
  • Оцени визуальное соответствие исходной схеме, понятность интерфейса и анимацию отдельно от правильности чтения данных. Две модели могут одинаково прочитать схему, но выдать результаты разного качества по подаче.
  • Проверь, выделены ли слабые этапы воронки и понятно ли, что нужно улучшить. Не ограничивайся первым найденным узким местом: в контрольном примере таких мест было два.

Восстановленная формулировка по описанию задачи. Полный исходный промпт и фотография в приложенном материале отсутствуют. Перед запуском приложи свою схему.

Промпт: симуляция по фотографии1 строка · 248 знаков
По приложенной фотографии схемы воронки мастер-класса создай интерактивную симуляцию. Нужно понять, какие показатели воронки необходимы, чтобы заработать 4 миллиона рублей. Предусмотри возможность сравнить получившуюся схему с исходной фотографией.

4. Проверь финансовый анализ и презентацию

  • Передай финансовые материалы и запроси анализ с презентацией. Используй высокий режим рассуждения, если повторяешь условия сравнения.
  • Проверь суммы на титульном слайде и внутри презентации. Сверь их с исходными данными и выводами анализа.
  • Просмотри все слайды: проверь графики, символ рубля, отсутствие сломанных элементов и полноту раскрытия задачи. Количество слайдов оценивай вместе с содержанием.
  • Проверь, обнаружены ли заложенные в исходных данных несоответствия. Сам факт обнаружения ловушек ещё не подтверждает достаточную глубину финансового анализа.
  • Сопоставь максимальную цену покупки бизнеса и обоснование этой цены. В контрольном примере выводы различались в 4,5 раза: 45 млн рублей у Claude Opus 5.5 и 10 млн рублей у GPT-6 Sol. Эти суммы относятся к конкретному кейсу, а не к оценке другого бизнеса.
  • Проверь, учтено ли условие эксклюзивности, если оно есть в документах. В контрольном примере значимый срок составлял 21 день.
  • Проверь обработку налога: модель рассчитала допустимый предел или только пометила налог как недостающие данные? Сверь вывод с тем, что действительно можно определить из исходных материалов.
  • Раздели мультипликатор, оценку по мультипликатору и максимальную цену покупки. В контрольном примере фигурировали кратность 10,9 у GPT-6 Sol и оценка 66,1 млн рублей по мультипликатору у Claude Opus 5.5; последняя не равна предложенному максимуму покупки в 45 млн рублей.
  • Проверь самопроверку модели: согласуются ли расчёты, выводы и цифры в презентации. Не принимай красивое оформление за подтверждение правильности оценки.

Восстановлена только минимальная постановка задачи. Полный исходный промпт, финансовые файлы и точные формулировки ловушек в приложенном материале отсутствуют; воспроизвести исходный тест без них нельзя.

Промпт: анализ с презентацией1 строка · 166 знаков
Проведи финансовый анализ бизнеса по приложенным материалам и подготовь презентацию с результатами. Определи максимальную цену, за которую можно покупать этот бизнес.

5. Проверь лимиты перед выбором подписки

  • Сопоставь ChatGPT Plus и Claude Pro на своём объёме работы. При бюджете около 20 долларов учитывай не только качество ответа, но и то, сколько задач удаётся закончить. Актуальные условия: использование Work и Codex, тарифы Claude.
  • Проверь фактический расход лимитов в своём аккаунте. Ориентиры на момент записи: 15–150 сообщений за 5 часов для ChatGPT Plus, втрое больше сообщений у Sol относительно Astra и повышение лимитов Claude Pro на 20%. Это данные исходного сравнения, а не гарантия текущих условий; «сообщения» здесь обозначают условные единицы расхода.
  • Не планируй выполнить все три тяжёлые задачи подряд в рамках базовой подписки без проверки остатка лимитов. Полный набор таких работ может потребовать ожидания их восстановления.

6. Распредели задачи между моделями

  • Проверь GPT-6 Sol в Codex на повседневных задачах, продумывании проектов и быстром взаимодействии, где долгое рассуждение не обязательно.
  • Если используешь CLI для других агентных оболочек, отдельно проверь свой сценарий с OpenClaw или Hermes Agent. Готовых команд подключения в исходном материале нет.
  • Проверь Claude Opus 5.5 на задачах, где важны архитектура, длительная самостоятельная работа и законченный результат после одного запроса.
  • Выбери модель по результату своей проверки: техническая корректность, глубина анализа, качество подачи, скорость и необходимое число доработок. При разных требованиях к задачам оставь обе модели в рабочем наборе.