Чек-лист

Claude или ChatGPT: разбор по трём типам пользователей и трём ценам

Ещё недавно ответ был очевиден. Я купил подписку за 100 $ специально, чтобы сравнение было честным, собрал одно и то же приложение в обеих моделях за один запрос и разобрал 90 новых интеграций. Ответ перестал быть однозначным — и зависит он от того, сколько ты платишь и чем занимаешься.

39 мин
Содержание12 глав
  1. 01Почему ответ перестал быть очевидным
  2. 02Полгода ChatGPT был догоняющим
  3. 03Что говорят бенчмарки, а что независимые издания
  4. 04Агенты, которые работают не на твоём компьютере
  5. 05Одно приложение, один запрос, две модели
  6. 06Codex рисует картинки прямо в проект
  7. 07Он видит экран и работает своим курсором
  8. 08Почему я перестал уходить в редактор кода
  9. 09Что выбрать под свою цену и задачу
  10. 10Три возражения по выбору
  11. 11Через шесть недель расклад сменится
  12. 12Посчитай свою цену и свою задачу

Почему ответ перестал быть очевидным

На днях я выпустил видео про Claude Opus 4.7, и там он буквально бил всех в каждом варианте тестирования. Но ChatGPT выходит со своей новой моделью, а ещё за последние несколько недель добавил автономных агентов и улучшил Codex.

И сегодня я уже не могу так очевидно ответить, что же лучше.

Чтобы сравнение было объективным, я купил равносильную подписку за 100 $. Иначе получилось бы нечестно: в одной модели у меня подписка за 200 $ со всем функционалом, а в другой её нет.

подписка куплена для сравнения
100 $
чтобы условия были равные
новых интеграций Codex
90
за одно апрельское обновление
приложение собрано за
1 запрос
в обеих моделях, для честного сравнения

Полгода ChatGPT был догоняющим

Есть деталь, которую не подсвечивают практически ни в одном обзоре профильных изданий. GPT 5.5 — первая полностью переобученная базовая модель за целых два года.

С момента выхода GPT 5 всё, что было между 5.1 и 5.4, дообучалось поверх старого. А здесь впервые за долгое время новая архитектура.

Понятно, почему так делали: крыть Claude было нечем. Claude выпускал сильные модели, Gemini выпускал осеннее обновление, а ChatGPT приходилось догонять. В роли догоняющего он был все эти месяцы.

ПРАВИЛО
Смотри не на номер версии, а на то, переобучена модель или дообучена поверх старой. Это разные величины изменений.

Что говорят бенчмарки, а что независимые издания

OpenAI отмечает, что GPT 5.5 может делать гораздо большую задачу, не теряя контекст и с меньшим количеством согласований. По их бенчмаркам почти везде выигрывает либо GPT 5.5, либо GPT 5.5 Pro.

Но интереснее посмотреть на независимые оценки. И они тоже говорят, что GPT 5.5 невероятен в использовании: в терминальных задачах он лидирует с огромным отрывом, в задачах по кибербезопасности тоже.

Хотя по совокупности баллов Claude Opus всё равно выигрывает — просто ChatGPT начал лидировать в отдельных задачах.

Claude Opus 4.7
выигрывает
совокупность балловвыигрывает
отдельные задачиуступает в терминальных
архитектурасильные модели весь год
GPT 5.5
уступает
совокупность балловуступает
отдельные задачилидирует с огромным отрывом
архитектурапервое переобучение за два года

Агенты, которые работают не на твоём компьютере

22 апреля представили агентов рабочей области. Разница с тем, что было, принципиальная.

Claude Cowork работает локально у вас на компьютере. У Claude есть и облачные варианты, но они либо непонятны массовому пользователю, либо работают через программный доступ. Агенты ChatGPT доступны прямо в подписке.

Можно описать словами: создай мне агента, который будет искать новых лидов, сортировать их и отправлять по почте. Он сразу предлагает интеграции — почту, календарь, дополнительный поиск.

Отличие в том, что агент работает удалённо, а не на вашем компьютере. Минус — интеграций чуть меньше. Плюс огромный: можно настроить нормальное автоматическое исследование, и когда приходит лид из почты или формы, агент сам загонит его в рабочий чат команды.

лид приходит из почты или формы
агент подхватывает удалённо
сортирует
отправляет в рабочий чат команды

Одно приложение, один запрос, две модели

Главную проверку я сделал так: собрал одно и то же приложение в Claude Opus 4.7 и в ChatGPT через Codex. Специально за один запрос, чтобы сравнение было чистым.

И я просто офигел от того, какой GPT 5.5 делает красивый дизайн. Вот приложение для учёта финансов, полученное за один запрос. Там классный дизайн, графики, настройки. Есть интерфейс, куда я пишу обычным текстом: потратил 1200 на обед с Никитой — и он сам распознаёт трату и вносит её в нужную категорию.

История трат готова сразу. Есть автоматические подсказки по тому, что удалось отследить. Есть настройки с экспортом бюджета. И он это даже выложил в сеть, мы уже не сидим на локальной машине.

Если до этого казалось, что Claude такой умный, держит длинный контекст и может собрать классное приложение за один запрос, а Codex не может — надо признать: мы устарели, сидя на одном Claude Code и не видя вокруг себя ничего.

01
Один запрос
условия равные
одинаковый для обеих моделей
02
Дизайн
за тот же один запрос
графики, настройки, готовый вид
03
Разбор текста
без ручного ввода
«потратил 1200 на обед» разносится по категориям
04
Автоподсказки
сами по себе
выводы по тому, что удалось отследить
05
Публикация
сразу рабочее
выложено в сеть, не на локальной машине

Codex рисует картинки прямо в проект

Отдельно то, чего я не ожидал: Codex теперь генерирует изображения прямо внутри себя.

Вот макеты приложения, которые он создавал просто по моему запросу в чате. Я сначала думал, что он делает скриншоты — а нет, он их сгенерировал, вставив наш логотип и остальную графику.

Покажу, зачем это на практике. У меня на сайте есть аватары как бы реальных пользователей — для большей открытости рядом с цифрой пользователей. Раньше я генерил их в Nano Banana, потом переносил в Claude Code. Теперь можно просто попросить Codex: сгенерируй мне 10 аватаров и вставь их в эти кружочки. И он это сделает.

Просто представьте, какая экономия времени.

3 шага
сгенерировать в Nano Banana, перенести, вставить в код
1 фраза
сгенерируй 10 аватаров и вставь в кружочки

Он видит экран и работает своим курсором

Возможности Codex вышли за пределы написания кода. Благодаря фоновой работе с компьютером он может использовать все приложения: видит происходящее на экране, нажимает и печатает собственным курсором. Несколько агентов работают параллельно, не мешая основной работе.

В одном окне мы приложение создаём, в другом он сам всё прокликивает и тестирует.

Добавили и браузер, который запускается сам, когда нужен. Создал сайт — можно сразу открыть и посмотреть. Похоже на то, как работает Claude Design: пишешь комментарий, меняешь картинки и текст. У Claude Design это реализовано немного лучше, но история та же.

А количество плагинов меня добило: работа с компьютером, работа с браузером, таблицы, презентации, хранилище кода, дизайн-редактор. Большинство приложений были и раньше, но 90 новых интеграций добавили за одно апрельское обновление.

работа с компьютером — видит экран
печатает курсором
работа с браузером — запускается сам
когда нужен
хранилище кода — работа с проектом на месте
дизайн-редактор — правки без выхода из среды
генерация изображений

Почему я перестал уходить в редактор кода

Если кто-то из вас пользовался Claude Desktop, там всё плохо и приходится идти в редактор кода. Здесь я этого ни разу не сделал, у меня даже желания такого не возникло.

Для того, кто только начинает, устроено удобно: файловой системы изначально нет, но открыть её можно. Терминал подключается прямо здесь — в Claude Desktop такого нет, если не считать терминальную версию и версию внутри редактора.

Можно открыть дополнительные среды разработки, настроить запуск, видеть количество строк кода и все файлы. Не нужно сидеть где-то отдельно.

И самое крутое: всю работу продолжаешь в этом же окне. Здесь подключения к внешним сервисам, здесь скиллы, здесь правки локально, здесь генерация картинок. Всё в одном месте. На мой взгляд, Codex — невероятный выбор, если вы хотите попробовать вайб-кодинг сегодня.

ПРАВИЛО
Считай не функции, а число окон, между которыми ты прыгаешь за одну задачу. Это и есть разница между инструментом и средой.

Что выбрать под свою цену и задачу

Теперь главное. Я изучил обе модели на подписке за 100 $, посмотрел, что даёт подписка за 20 $, а за 200 $ то же самое, что за 100, только лимиты больше. Разделим по трём типам пользователей.

Первый: совсем новичок, денег нет, хочется попробовать бесплатно или совсем задёшево. Второй: уже пробуете, но это не профессиональная деятельность — хотели бы разрабатывать приложения, но бюджета и времени пока немного. Третий: вы на этом зарабатываете, приложения приносят деньги, это часть бизнес-процесса.

подписка 20 $ChatGPT, это просто небо и земля
новичок, нужны картинки, код и текст сразуChatGPT
больше обычных задач в чатеClaude всё ещё лучше
вайб-кодинг на 100 $Claude часто не хватает, брать ChatGPT
профессиональная работа на 200 $оставлял бы Claude
цикл обновлений моделейоколо шести недель

Три возражения по выбору

Раз ChatGPT догнал, надо переходить
За 100 $ на вайб-кодинге — да, Claude часто будет не хватать. Но если у вас больше обычных задач в чате, Claude всё ещё лучше
Тогда за 200 $ тоже брать ChatGPT
Здесь я бы всё равно оставил Claude. Нейросети обновляются примерно шестинедельными циклами, и сегодняшнее обновление означает лишь то, что ближайшие несколько недель ChatGPT будет чуть стабильнее
Значит, разница в моделях решающая
Не вижу сильной разницы в качестве обычных моделей за последние полгода. Между Claude Opus 4.5 и 4.7 в исследовании, продумывании и контенте разницы нет. Между версиями GPT — тоже. Они как были нормальными, так и остаются. Не хватало агентности и самостоятельности — вот это и сделали

Через шесть недель расклад сменится

Как показывал рынок последние полгода, Claude всегда не просто навёрстывал, а был на шаг впереди. Думаю, совсем скоро мы увидим новую модель, о которой я рассказывал в одном из предыдущих видео.

Поэтому воспринимайте этот разбор как срез на сегодня, а не как приговор.

ЧЕСТНО
Я не защищаю ни одну сторону. Сегодня я честно говорю, что за 100 $ на вайб-кодинге выигрывает не тот инструмент, которым пользуюсь я сам.

Посчитай свою цену и свою задачу

Ты дочитал до конца — значит, вопрос не в том, какая модель умнее. По обычным задачам они сравнялись, и это признают обе стороны. Вопрос в том, сколько ты платишь и что именно делаешь: разговариваешь в чате или собираешь приложения.

Один вопрос напоследок. Ответь себе одним предложением: за что конкретно ты платишь свою подписку в этом месяце — за качество ответов или за то, чтобы агент работал вместо тебя? От этого ответа и зависит выбор, а не от бенчмарков. Я читаю.

100 $ — подписка сравнения
90 — новых интеграций
1 — запрос на приложение
3 — типа пользователей