# Kimi K3 убил Claude? Хайп против реальности

Правда ли китайская Kimi K3 обошла Codex и Claude в разработке: разбираю бенчмарки, стоимость токенов, скорость и реальные ограничения модели.

## Хайп против реальности

16 июля китайский Kimi K3 вышел на первое место в кодинг-арене. Весь ютуб кричит: в три раза дешевле и умнее всех. Я пишу код в Claude Code каждый день — поэтому сел и пересчитал счёт сам.

«ЮТУБ КРИЧИТ»: «в 3 раза дешевле», «умнее всех», «#1, выше Claude во всём»

> Главную цену за Kimi K3 ты платишь вообще не в долларах. Разложу по цифрам, где он реально порвал Claude, а где тебя разводят на хайпе. — Рома Райт

## Что за зверь Kimi K3 и почему все сходят с ума

Kimi K3 — модель китайской Moonshot AI, вышла 16 июля 2026. Считает она не всей махиной сразу: это MoE — модель думает не целиком, а включает под задачу только 16 экспертов из 896, около 50 миллиардов параметров на токен. Плюс миллион токенов контекста и нативная мультимодальность в одной модели.

карточка 1 — метка «думает не целиком» / значение «16 из 896» / капшен «активных экспертов»; карточка 2 — метка «на токен» / значение «≈ 1,8% модели» / капшен «около 50 млрд параметров»

## «Открытые веса» не значит «запущу дома»

Слово «открытые» кружит голову: качай и запускай локально. На деле это около 1,4 терабайта весов даже в сжатии. Это датацентр, а не твой ноутбук.

карточка 1 — метка «твой ПК / ноутбук» / значение «1,4 ТБ весов» / капшен «не потянет — ни памяти, ни весов»

врезка `// по сути`: текст «Открытые веса — это про аудит, приватность и свой инференс на серьёзном железе. Не про то, что ты завтра поднимешь модель на своём ноуте.»

## Здесь он действительно #1 — фронтенд-арена

На арене WebDev люди вслепую голосуют, чей результат лучше. 16 июля Kimi K3 набрал рейтинг Elo 1679 и встал на первое место — выше Claude Fable 5 и GPT-5.6 Sol. Плюс он лидер в 6 из 7 фронтенд-доменов, а его прошлая версия была лишь на 18-м месте.

строки «Показатель → Значение»: Kimi K3 · #1 → 1679; Claude Fable 5 → 1631; GPT-5.6 Sol → 1618. Сноска: «арена WebDev · рейтинг Elo из слепых голосов людей · 16.07»

врезка `// Честная оговорка`: текст «Это слепые голоса людей и снапшот одного дня. Лидер на арене меняется.»

## На фронтенде — король. По уму и фактам — один из худших

Сводный балл ума по всем тестам расставляет иначе: Claude Fable впереди, GPT следом, Kimi K3 — только третий-четвёртый. А главный разворот — на знаниях и галлюцинациях.

строки «Показатель → Значение»: Claude Fable 5 → ~60; GPT-5.6 Sol → ~59; Kimi K3 · #3–4 → ~57. Сноска: «сводный балл ума по всем тестам»

карточка 1 — метка «точность у K3» / значение «33% → 46%» / капшен «стал точнее»; карточка 2 — метка «галлюцинации у K3» / значение «39% → 51%» / капшен «и врёт чаще — одновременно»

## «В три раза дешевле» — цена за токен, а не за задачу

На бумаге токен K3 и правда дешёвый: вход и выход — примерно 30% от тарифа дорогого Claude Fable. Отсюда и «в три раза». Но платишь ты не за токен, а за решённую задачу. А там картина другая.

строки «Показатель → Значение»: Kimi K3 → $3 / $15; GPT-5.6 Sol → $5 / $30; Claude Fable 5 → $10 / $50. Сноска: «цена за 1 млн токенов · вход / выход — вот отсюда «в 3 раза дешевле»»

врезка `// образ`: текст «Тариф-то копеечный. Но счётчик мотает дольше — как такси, что стоит в пробке: цена за километр смешная, а по итогу поездки платишь как за весь город.»

## Расплата №1. Многословность: дешёвый токен × куча токенов

Kimi K3 прожорлив на токены. На одном прогоне тестов он выдал вдвое больше токенов, чем в среднем выдают модели. Дешёвый токен, умноженный на такое количество, и даёт обычный счёт.

строки «Показатель → Значение»: среднее по моделям → ~63 млн; Kimi K3 · ×2 → ~130 млн. Сноска: «объём токенов на прогоне тестов»

врезка `// образ`: текст «Он многословный, как коллега, который на короткий вопрос отвечает тремя страницами. Вроде и толково — но читать до вечера.»

карточка 1 — метка «Kimi K3» / значение «21,5 млн токенов» / капшен «1 ч 33 мин»; карточка 2 — метка «Fable 5» / значение «3,5 млн токенов» / капшен «17 мин»; карточка 3 — метка «Codex (5.6)» / значение «5,6 млн токенов» / капшен «25 мин»

_личный замер одного автора — для иллюстрации, не бенчмарк_

Беру только как наглядную иллюстрацию, до чего K3 многословный — не как точную цифру.

## Расплата №2. Доверие и время — вот где настоящий счёт

Цена №1 — галлюцинации. K3 врёт в половине сложных вопросов, Claude Fable — в шестой части. Цена №2 — время, но тут важный нюанс: это не тупое «медленнее».

карточка 1 — метка «Kimi K3» / значение «51%» / капшен «врёт в сложных вопросах»; карточка 2 — метка «Claude Fable 5» / значение «16%» / капшен «врёт в сложных вопросах». Ключевая — #1

_по шкале знаний это +18 против +40 — K3 среди самых врущих во фронтире_

строки «Показатель → Значение»: Fable — токенов в секунду → 66,6; K3 — токенов в секунду → 62,0; GPT-5.6 — токенов в секунду → 55,0. Сноска: «скорость — не тупое «медленнее». K3 быстрее GPT на токен»

карточка 1 — метка «время до первого ответа» / значение «1,99 с» / капшен «Kimi K3 — почти мгновенно»; карточка 2 — метка «время до первого ответа» / значение «131,30 с» / капшен «GPT-5.6 Sol — в пике, худший случай»

врезка `// точная формулировка`: текст «Медленный он только по общему времени на всю задачу — потому что многословный. По скорости токена и по старту он GPT обгоняет.»

## Кому брать Kimi K3, а кому нет

- НЕ БРАТЬ: где цена ошибки высокая — юр., мед., цифры, данные: 51% галлюцинаций
- НЕ БРАТЬ: когда важен быстрый результат по времени, а не цена токена
- НЕ БРАТЬ: если ты соло без датацентра — «открытые веса» лично тебе не про локальный запуск

врезка `// МОЙ ВЕРДИКТ`: текст «Claude Code остаётся дефолтом на ежедневку — за надёжность. Kimi K3 беру вторым пилотом: на фронтенд и черновики.»

> Не выбирай модель по одной цифре из твиттера. Считай свою задачу, а не чужой график.

## Итог: где правда, а где маркетинг

- 01 «Open-weight-модель впервые догнала фронтир по коду — это правда, а не «китай-хайп».»
- 02 ««Дёшево и быстро» — маркетинг» — Против GPT он не дешевле в разы, а по времени на задачу дольше.

> Настоящая цена Kimi K3 — не доллары. Это доверие. Он врёт в половине сложных вопросов, и это не чинится дешёвым токеном.

---

Источник: https://localhost:3000/m/kimi-k3-%D1%83%D0%B1%D0%B8%D0%BB-claude-%D1%85%D0%B0%D0%B9%D0%BF-%D0%BF%D1%80%D0%BE%D1%82%D0%B8%D0%B2-%D1%80%D0%B5%D0%B0%D0%BB%D1%8C%D0%BD%D0%BE%D1%81%D1%82%D0%B8
