Гайд

Claude Fable 5.1: до 45% дешевле и вдвое сильнее в двух тестах

Разбираем цены, режимы усилий и один тест четырёх моделей, в котором красивый интерфейс оказался менее важен, чем выполненная задача.

Содержание12 глав
  1. 01Обновление на одну десятую, которое меняет выбор модели
  2. 02Три цены одного входного токена
  3. 03Не начинай любую задачу с самой дорогой модели
  4. 04Модель и уровень усилий – не одно и то же
  5. 05Где разница почти не видна, а где становится огромной
  6. 06Плотнее проза, меньше форматирования и новая метка
  7. 07Скорость не предсказала качество
  8. 08Что получилось у каждой модели
  9. 09Лучше ошибка в компоненте, чем невыполненная задача
  10. 10Мой рабочий выбор после теста
  11. 11Ссылки из разбора
  12. 12Не верь названию версии – проверяй на своей задаче

Обновление на одну десятую, которое меняет выбор модели

Anthropic обновила Claude Fable 5 до Fable 5.1. По названию кажется, что перед нами обычная промежуточная версия. Но я дал одну и ту же задачу Claude Fable 5.1, Claude Fable 5, Claude Opus 5 и GPT-5.6 Sol. На реальном интерфейсе разница оказалась намного заметнее, чем в таблице характеристик.

Главное изменение не в цене входа или выхода. Оно в чтении кэша. Именно эта строка определяет стоимость длинных разговоров, работы с большими файлами и агентных задач, где модель снова и снова читает уже переданный контекст.

типичная нагрузка
около 25%
оценка снижения стоимости от Anthropic
агентная работа
до 45%
экономия при высокой доле чтения кэша
чтение кэша
−75%
в четыре раза дешевле, чем у Fable 5

Чем длиннее задача и стабильнее контекст, тем заметнее новая экономика.

экономика

Три цены одного входного токена

Теперь считать только вход и выход недостаточно. У входного контекста есть обычное чтение, запись в кэш и повторное чтение кэша. У Fable 5.1 обычный вход стоит 10 долларов за миллион токенов, выход – 50 долларов, а чтение кэша – 0,25 доллара. Поэтому короткий разговор с нуля почти не меняется, а длинная рабочая сессия может стать заметно дешевле.

ОперацияЦена за 1 млн токенов
Обычный вход$10
Выход$50
Чтение кэша$0,25
Тарифы Claude Fable 5.1 по официальной документации Anthropic на дату выхода модели.
простое правило
Скидка пропорциональна доле кэш-чтения. Если каждый запрос начинается с нуля, чудесной экономии не будет.

выбор модели

Не начинай любую задачу с самой дорогой модели

В обычной работе с кодом я не увидел разницы, ради которой нужно всегда включать Fable 5.1. Поменять кнопку, поправить небольшой баг или внести локальную правку можно на Sonnet. Большую кодовую задачу логичнее начинать с Opus 5. Fable 5.1 имеет смысл подключать там, где нужна длинная агентная работа, тяжёлое рассуждение, проектирование логики или интерфейса.

небольшая правка
Sonnet 5
кнопка, текст, простой локальный баг
большая задача
Opus 5
рабочая модель по умолчанию для серьёзной разработки
длинный горизонт
Fable 5.1
архитектура, интерфейс, исследование и автономная работа

режимы

Модель и уровень усилий – не одно и то же

Даже сильная модель может работать хуже, если снизить уровень усилий. В Claude Code Fable 5.1 по умолчанию стартует на High, а в Claude Cowork и Claude.ai – на Medium. Для простой задачи это помогает экономить. Для сложной логики я бы не соглашался на редкий поиск и ответы по памяти только ради меньшего расхода лимита.

01
Оцени задачу
локальная или системная
Кнопке не нужен максимальный режим. Архитектуре и сложному интерфейсу нужен
02
Выбери модель
Sonnet, Opus или Fable
Сначала бери самую дешёвую модель, которая стабильно закрывает этот класс задач
03
Подними усилия
High, X High или Max
Если модель срезает поиск и отвечает по памяти, проблема может быть в режиме, а не в её интеллекте

личная практика

Где разница почти не видна, а где становится огромной

На обычных кодовых правках Fable 5 и Fable 5.1 для меня выглядели близко. Разница появилась не в количестве написанных строк, а в том, как модель продумывает продукт: композицию экрана, интерактивность, логику поведения и один эффект, ради которого пользователь захочет остаться.

С длинными списками багов картина другая. Если отправить модели страницу Notion примерно с 20 проблемами, Fable может самостоятельно закрыть около половины. Opus в таком сценарии способен остановиться после нескольких исправлений. Это не универсальный бенчмарк, а мой рабочий опыт: длинный горизонт действительно раскрывает старшую модель.

локальная правка
разница между версиями небольшая
чем длиннее горизонт, тем заметнее преимущество
система целиком
Fable 5

поведение

Плотнее проза, меньше форматирования и новая метка

Fable 5.1 пишет плотнее, реже дробит ответ форматированием и аккуратнее работает с длинными файлами. Но вместе с этим Anthropic добавила происхождение контента: ответы могут получать машинно определяемую водяную метку. Если нейросеть только помогает со сценарием, а финальный текст проходит через человека, для меня это не проблема.

Если ты выпускаешь нейросетевой текст или карусель почти без изменений, решение уже твоё. С одной стороны, платформа может учитывать происхождение контента. С другой – удалять маркировку ради ложного представления полностью нейросетевой работы как человеческой рискованно. Репозиторий ниже заявлен автором как инструмент для контента, которым владеешь ты сам.

Открыть Watermarks Remover на GitHub

реальный тест

Чтобы сравнить не обещания, а результат, я дал четырём моделям одинаковую задачу. Никакого длинного технического задания и ручного объяснения дизайна. Каждая модель сама выбирала структуру, визуальный язык и интерактивность. Ограничение было одно: весь сайт должен работать в одном файле.

Один промт, четыре модели, один экран1 строка · 253 знака
Сделай живую карту дня и ночи. Один экран, который показывает Землю прямо сейчас: где светло, где темно, где проходит рассвет и который час. Весь сайт должен работать в одном файле. Остальные решения по интерфейсу и интерактивности прими самостоятельно.

Задача для сравнения моделей

Один файл не мешает модели показать максимум. Мы проверяем это ещё со времён Opus 4.8. Когда интерфейс, логика и данные собраны внутри одного документа, слабое место видно быстрее: модель либо поняла задачу и сделала работающий эффект, либо спрятала пустоту за аккуратными карточками.

время работы

Скорость не предсказала качество

Все четыре модели работали от 30 до 47 минут. Самый быстрый результат дал Opus 5, самый долгий – Fable 5.1. Но время само по себе ничего не объяснило. Важнее оказалось, выполнила ли модель центральную задачу и придумала ли взаимодействие, которое нельзя заменить статичной картинкой.

МодельВремя выполнения
Claude Opus 530 минут
Claude Fable 535 минут
GPT-5.6 Sol40 минут
Claude Fable 5.147 минут
В одном из прогонов соединение прерывалось, поэтому время – ориентир, а не лабораторный замер.

разбор результатов

Что получилось у каждой модели

GPT-5.6 Sol сделал рабочий экран, который полгода назад выглядел бы впечатляюще. Сейчас его выдали одинаковая типографика, вложенные друг в друга карточки и плоский дизайн. Fable 5 тоже собрал базовый вариант с координатами при наведении, но по общему ощущению ушёл недалеко от GPT.

Opus 5 добавил управление временем: паузу, ускорение и движение солнечной границы. При этом на карте потерялась Россия. Fable 5.1 допустил собственную ошибку в компонентах карты, зато сделал главный вау-эффект: карта масштабируется, точки раскрываются, а карточки состояния живут вместе с движением дня и ночи.

GPT-5.6 Sol
рабоче, но плоско
повторяющиеся карточки и узнаваемая типографика
Claude Fable 5
базовая карта
координаты есть, заметного скачка нет
Claude Opus 5
интерактивное время
пауза и ускорение, но ошибка в географии
Claude Fable 5.1
лучший вау-эффект
задача решена, локальный компонент можно поправить

главный вывод

Лучше ошибка в компоненте, чем невыполненная задача

Локальный дефект карты можно исправить одним следующим запросом. Отсутствие идеи так не лечится: придётся заново объяснять модели, какой эффект ты хотел получить. Поэтому я выбираю результат, где центральная задача решена, даже если один компонент требует правки.

критерий выбора
Сначала проверь, поняла ли модель продуктовую задачу. Только потом считай количество мелких визуальных ошибок.

что делать

Мой рабочий выбор после теста

  • Используй Sonnet 5 для небольших и понятных правок.
  • Начинай серьёзную кодовую работу с Opus 5, если задача не требует длинного горизонта.
  • Переключайся на Fable 5.1 для архитектуры, проектирования интерфейсов и длительной агентной работы.
  • Проверяй уровень усилий: Medium может экономить лимит ценой глубины поиска.
  • Оценивай выполнение центральной задачи раньше визуальной полировки.
  • Исправляй локальные ошибки отдельным запросом, не перезапускай удачную работу с нуля.
  • Не убирай водяную метку автоматически: сначала определи, кому принадлежит контент и какие правила действуют на площадке.

материалы

Ссылки из разбора

Ниже только страницы, которые открылись и совпали с тем, о чём говорится в видео. Ссылки на прошлый ролик про кэш, обучение и дополнительные материалы нельзя восстановить по транскрипту: для них нужен исходный список из описания видео.

Официальный анонс Claude Fable 5.1

Характеристики и цены Claude Fable 5.1

Документация Anthropic по кэшированию

Watermarks Remover на GitHub

финал

Не верь названию версии – проверяй на своей задаче

Fable 5.1 не делает каждую операцию магически лучше. Для небольшой правки разница может вообще не окупить расход лимита. Но когда нужно удерживать длинную цепочку решений, придумать интерфейс и самостоятельно довести идею до работающего результата, новая версия показывает тот самый отрыв, которого не видно в обычном чате.

Мне проще один раз поправить компонент, чем заново объяснять модели, в чём вообще была задача.