Модели

Kimi K3: почему открытым весам Moonshot AI поверили миллионы

Kimi — семейство моделей китайской Moonshot AI. Летом 2026 года компания выпустила Kimi K3 — модель с 2,8 триллиона параметров, контекстом в миллион токенов и, что важнее, открытыми весами: первая открытая модель класса «3 триллиона». Разбираем, что это даёт обычному пользователю и разработчику.

Актуальные модели Kimi

Kimi K3 вышла 16 июля 2026 года, а 27 июля Moonshot опубликовала веса и технический отчёт. Архитектурно это MoE с 896 экспертами, из которых активны 16, плюс гибридный механизм внимания KDA (Kimi Delta Attention). На момент выхода это была самая крупная открытая модель в мире.

Цены выросли по сравнению с K2.6: $3/$15 против $0.95/$4. Moonshot явно целится в сегмент Claude Sonnet, а не в гонку «самая дешёвая модель». Версия K2.7 Code, наоборот, осталась нишевой и недорогой — для программирования.

МодельЧто этоЦена за 1 млн токенов
Kimi K3Флагман: 2,8T параметров (MoE), 1M контекст, открытые веса$3 вход / $15 выход
Kimi K2.7 CodeСпециализация на коде и агентных задачахДешевле флагмана, есть highspeed-вариант
Kimi K2.6Прошлое поколение, мультимодальный ввод$0.95 / $4

Насколько это умно

По собственным бенчмаркам Moonshot K3 обходит Claude Opus 4.8 и GPT-5.5, но уступает Claude Fable 5 и GPT-5.6 Sol — то есть это модель «верхнего среднего» уровня, на границе флагманов. Независимый тест Artificial Analysis даёт похожую картину: по длинным задачам K3 вторая после Claude Fable 5.

Интересный факт для разработчиков: K3 вышла на первое место в Arena.ai Frontend Code — публичном рейтинге генерации веб-интерфейсов. Если нужно быстро собрать работающий фронтенд из описания, K3 сейчас один из лучших инструментов. По агентным задачам модель экономнее предшественницы: на 21% меньше выходных токенов на тот же объём работы.

Безопасность и отказы

Kimi заметно мягче западных флагманов в отказах на спорных технических и творческих темах — это одна из причин её популярности. Регуляторные ограничения по политическим вопросам присутствуют, как и у всех моделей, обученных в Китае, но на повседневных задачах они почти не заметны.

Открытые веса позволяют развернуть модель на своей инфраструктуре и убрать сервисный слой — это плюс для конфиденциальности. Оборотная сторона: ответственность за использование и контроль качества ложатся на вас, а встроенные фильтры сервиса Moonshot при этом исчезают.

Отдельный штрих к портрету компании: после запуска K3 спрос был так высок, что Moonshot временно останавливала регистрацию новых подписок — не хватало GPU. Это к вопросу о стабильности: в пиковые периоды доступность может плавать.

Сколько стоит задача

По оценке Artificial Analysis, стоимость одной агентной задачи у K3 — около $0.94, у GPT-5.6 Sol — $1.04, у Claude Opus 4.8 — $1.80. То есть K3 сопоставима с OpenAI по цене задачи и вдвое дешевле Claude при близком качестве.

Если бюджет жёсткий, смотрите на K2.7 Code для программирования: специализированная модель заметно дешевле флагмана и закрывает код-задачи на уровне, которого хватает большинству команд.

Особенности работы

  • Контекст 1 048 576 токенов (1M) — документы, репозитории и длинные диалоги целиком.
  • Принимает текст и изображения; на выходе — только текст.
  • Открытые веса под лицензией Kimi K3: коммерческое использование требует отдельного соглашения — читайте условия до встраивания в продукт.
  • Скорость генерации около 32 токенов в секунду; первый токен приходит медленно из-за долгих размышлений — для интерактивного чата это заметно.
  • Ограничение: один уровень глубины размышлений, без гибкой настройки effort, как у OpenAI и Anthropic.

Кому подходит

Kimi K3 — выбор для тех, кому нужен почти флагманский интеллект по умеренной цене: длинные аналитические задачи, генерация фронтенда, работа с большими документами на русском (языковая поддержка у K3 хорошая, включая русскоязычные диалоги).

Разработчикам интересен открытый доступ: веса скачаны с Hugging Face миллион раз, и крупные облачные провайдеры уже обсуждали сервисы на базе K3. Для локального запуска модель тяжёлая — нужен кластер, а не домашний ПК; для этого лучше подходят младшие Qwen. А если приоритет — предсказуемое поведение в строгих корпоративных сценариях, посмотрите в сторону Claude, который в таких задачах отказывает осмысленнее, а не чаще. Обе модели, вместе с актуальными OpenAI и Google, есть в каталоге ANY LLM — сравнить их проще всего на одном и том же запросе в чате.

Частые вопросы

Kimi K3 бесплатная?

Веса открыты для скачивания, но запуск требует серьёзного железа. Через сайт kimi.com и API модель платная: $3/$15 за миллион токенов, с бесплатными лимитами на сайте.

Чем Kimi отличается от ChatGPT?

Kimi дешевле на задачу и мягче в отказах, OpenAI шире по продуктам и стабильнее в обслуживании. По «чистому интеллекту» флагманы обеих компаний близки.

Можно ли использовать K3 в коммерческом продукте?

Веса идут под лицензией Kimi K3: коммерческое использование требует отдельного соглашения с Moonshot. Не встраивайте модель в продукт, не прочитав лицензию.

Почему Kimi отвечает медленно?

Модель долго думает перед ответом (time to first token измеряется минутами на сложных задачах). Для интерактивного чата это заметно; для фоновой обработки — не проблема.

Что выбрать: Kimi K3 или Qwen3.8-Max?

Обе — китайские модели с 1M контекста. K3 немного дешевле на задачу и открыта, Qwen сильнее в русском и гибче по линейке. Лучший способ решить — прогнать обе на своей задаче, например в чате ANY LLM.

Источники

Как мы проверяем материалы

Читайте также