Модели
Kimi K3: почему открытым весам Moonshot AI поверили миллионы
Kimi — семейство моделей китайской Moonshot AI. Летом 2026 года компания выпустила Kimi K3 — модель с 2,8 триллиона параметров, контекстом в миллион токенов и, что важнее, открытыми весами: первая открытая модель класса «3 триллиона». Разбираем, что это даёт обычному пользователю и разработчику.
Актуальные модели Kimi
Kimi K3 вышла 16 июля 2026 года, а 27 июля Moonshot опубликовала веса и технический отчёт. Архитектурно это MoE с 896 экспертами, из которых активны 16, плюс гибридный механизм внимания KDA (Kimi Delta Attention). На момент выхода это была самая крупная открытая модель в мире.
Цены выросли по сравнению с K2.6: $3/$15 против $0.95/$4. Moonshot явно целится в сегмент Claude Sonnet, а не в гонку «самая дешёвая модель». Версия K2.7 Code, наоборот, осталась нишевой и недорогой — для программирования.
| Модель | Что это | Цена за 1 млн токенов |
|---|---|---|
| Kimi K3 | Флагман: 2,8T параметров (MoE), 1M контекст, открытые веса | $3 вход / $15 выход |
| Kimi K2.7 Code | Специализация на коде и агентных задачах | Дешевле флагмана, есть highspeed-вариант |
| Kimi K2.6 | Прошлое поколение, мультимодальный ввод | $0.95 / $4 |
Насколько это умно
По собственным бенчмаркам Moonshot K3 обходит Claude Opus 4.8 и GPT-5.5, но уступает Claude Fable 5 и GPT-5.6 Sol — то есть это модель «верхнего среднего» уровня, на границе флагманов. Независимый тест Artificial Analysis даёт похожую картину: по длинным задачам K3 вторая после Claude Fable 5.
Интересный факт для разработчиков: K3 вышла на первое место в Arena.ai Frontend Code — публичном рейтинге генерации веб-интерфейсов. Если нужно быстро собрать работающий фронтенд из описания, K3 сейчас один из лучших инструментов. По агентным задачам модель экономнее предшественницы: на 21% меньше выходных токенов на тот же объём работы.
Безопасность и отказы
Kimi заметно мягче западных флагманов в отказах на спорных технических и творческих темах — это одна из причин её популярности. Регуляторные ограничения по политическим вопросам присутствуют, как и у всех моделей, обученных в Китае, но на повседневных задачах они почти не заметны.
Открытые веса позволяют развернуть модель на своей инфраструктуре и убрать сервисный слой — это плюс для конфиденциальности. Оборотная сторона: ответственность за использование и контроль качества ложатся на вас, а встроенные фильтры сервиса Moonshot при этом исчезают.
Отдельный штрих к портрету компании: после запуска K3 спрос был так высок, что Moonshot временно останавливала регистрацию новых подписок — не хватало GPU. Это к вопросу о стабильности: в пиковые периоды доступность может плавать.
Сколько стоит задача
По оценке Artificial Analysis, стоимость одной агентной задачи у K3 — около $0.94, у GPT-5.6 Sol — $1.04, у Claude Opus 4.8 — $1.80. То есть K3 сопоставима с OpenAI по цене задачи и вдвое дешевле Claude при близком качестве.
Если бюджет жёсткий, смотрите на K2.7 Code для программирования: специализированная модель заметно дешевле флагмана и закрывает код-задачи на уровне, которого хватает большинству команд.
Особенности работы
- Контекст 1 048 576 токенов (1M) — документы, репозитории и длинные диалоги целиком.
- Принимает текст и изображения; на выходе — только текст.
- Открытые веса под лицензией Kimi K3: коммерческое использование требует отдельного соглашения — читайте условия до встраивания в продукт.
- Скорость генерации около 32 токенов в секунду; первый токен приходит медленно из-за долгих размышлений — для интерактивного чата это заметно.
- Ограничение: один уровень глубины размышлений, без гибкой настройки effort, как у OpenAI и Anthropic.
Кому подходит
Kimi K3 — выбор для тех, кому нужен почти флагманский интеллект по умеренной цене: длинные аналитические задачи, генерация фронтенда, работа с большими документами на русском (языковая поддержка у K3 хорошая, включая русскоязычные диалоги).
Разработчикам интересен открытый доступ: веса скачаны с Hugging Face миллион раз, и крупные облачные провайдеры уже обсуждали сервисы на базе K3. Для локального запуска модель тяжёлая — нужен кластер, а не домашний ПК; для этого лучше подходят младшие Qwen. А если приоритет — предсказуемое поведение в строгих корпоративных сценариях, посмотрите в сторону Claude, который в таких задачах отказывает осмысленнее, а не чаще. Обе модели, вместе с актуальными OpenAI и Google, есть в каталоге ANY LLM — сравнить их проще всего на одном и том же запросе в чате.
Частые вопросы
Kimi K3 бесплатная?
Веса открыты для скачивания, но запуск требует серьёзного железа. Через сайт kimi.com и API модель платная: $3/$15 за миллион токенов, с бесплатными лимитами на сайте.
Чем Kimi отличается от ChatGPT?
Kimi дешевле на задачу и мягче в отказах, OpenAI шире по продуктам и стабильнее в обслуживании. По «чистому интеллекту» флагманы обеих компаний близки.
Можно ли использовать K3 в коммерческом продукте?
Веса идут под лицензией Kimi K3: коммерческое использование требует отдельного соглашения с Moonshot. Не встраивайте модель в продукт, не прочитав лицензию.
Почему Kimi отвечает медленно?
Модель долго думает перед ответом (time to first token измеряется минутами на сложных задачах). Для интерактивного чата это заметно; для фоновой обработки — не проблема.
Что выбрать: Kimi K3 или Qwen3.8-Max?
Обе — китайские модели с 1M контекста. K3 немного дешевле на задачу и открыта, Qwen сильнее в русском и гибче по линейке. Лучший способ решить — прогнать обе на своей задаче, например в чате ANY LLM.