Модели
Qwen3.8-Max и открытые версии Qwen: что выбрать для работы на русском
Qwen — семейство моделей Alibaba и, пожалуй, главная альтернатива западным флагманам по цене. В 2026 году актуален Qwen3.8-Max — модель с 2,4 триллиона параметров и окном в миллион токенов за $2/$6, плюс открытые версии, которые можно запустить у себя. Разбираем линейку, лицензии (тут есть подводные камни) и то, что Qwen умеет по-русски.
Актуальные модели Qwen
Qwen3.8-Max вышел в августе 2026 года после презентации на конференции WAIC в Шанхае. Название скрывает необычную конструкцию: MoE (mixture-of-experts) с 2,4 триллионами параметров, из которых активны лишь около 95 миллиардов — поэтому цена за запрос не безумная, несмотря на размер.
Параллельно Alibaba выпускает открытые веса. Qwen3.8-27B — плотная модель, которая запускается на одной потребительской видеокарте с 24 ГБ памяти, и по заявлениям Alibaba конкурирует с гораздо более крупной Qwen3.7-Plus. Для локального запуска и изучения это сейчас один из лучших вариантов.
| Модель | Что это | Цена / лицензия |
|---|---|---|
| Qwen3.8-Max | Флагман: 2,4 трлн параметров (MoE), 1M контекст, текст+видео | $2 вход / $6 выход, закрытая API |
| Qwen3.8-27B | Открытая плотная модель, работает на одной видеокарте | Apache 2.0, бесплатно |
| Qwen3.8-Flash-Next | Предварительный показ архитектуры будущей Qwen4 | Qwen Community License |
| Qwen3.5 / 3.6 / 3.7 | Прошлые поколения, ещё в строю | Apache 2.0 (открытые версии) |
Насколько это умно
Флагман позиционируется для длинных агентных задач: многодневное автономное программирование, воспроизведение исследований, оркестрация нескольких агентов. Качество русского языка — традиционно сильное место Qwen: модель обучалась в том числе на большом объёме русскоязычных данных, и в русскоязычных задачах она часто обходит западные модели того же ценового класса.
Qwen3.8-Max принимает видео и изображения нативно. Важная оговорка: открытая версия флагмана (2.4T-A95B) — только текст, мультимодальность осталась в закрытой API-версии.
Безопасность и отказы
Qwen обучается под китайское регулирование: политические темы фильтруются заметно жёстче, чем у западных моделей, и это распространяется и на открытые веса. На бытовых и рабочих задачах отказы редкие — модель, скорее, наоборот, склонна отвечать на широкий круг технических вопросов.
Открытые веса дают дополнительную степень контроля: можно запустить модель локально, убрать сервисный слой и не передавать данные третьей стороне. Но нельзя «перепрошить» то, чему модель научилась: базовые отказы на политических темах остаются на уровне весов.
Сколько стоит задача
$2/$6 за миллион токенов у флагмана — это уровень Grok и в 2,5–15 раз дешевле GPT Sol или Claude Fable. Кэш-чтения — $0.25. Для массовой обработки текста на русском Qwen часто даёт лучшее соотношение цены и качества на рынке.
Локальный запуск бесплатен, но требует оборудования: 27B в 4-битном квантовании занимает около 17 ГБ памяти — нужна видеокарта уровня 24 ГБ или Mac с достаточным объёмом unified memory. Если оборудования нет, проще взять API-версию или дешёвую модель у агрегатора.
Особенности работы
- Контекст 262K токенов нативно, расширяется до 1 млн через YaRN у открытых моделей; у флагмана — 1M из коробки.
- Thinking-режим включён по умолчанию у новых моделей, отключается на уровне запроса; есть контроль глубины рассуждения (reasoning_effort).
- Лицензии различаются: Apache 2.0 у большинства открытых моделей, но у флагманских весов — собственная лицензия с условиями по выручке. Читайте лицензию до коммерческого использования.
- Семейство разрослось: отдельные модели для кода (Qwen3-Coder), изображений (Qwen-Image), речи и даже вождения (Qwen-Drive).
- Ограничение: обновления выходят очень часто — версии 3.5, 3.6, 3.7, 3.8 вышли в течение полугода, и ориентируться стоит на страницу моделей, а не на старые обзоры.
Кому подходит
Если задачи на русском языке и бюджет ограничен — Qwen первый кандидат: качество русского плюс низкая цена. Разработчикам интересны открытые веса: можно встраивать модель в свои продукты без расходов за токены. Qwen — не единственный китайский тяжеловес: у Moonshot AI со своим Kimi своя философия, и сравнение этих двух линеек полезно читать парами.
Для строго западного корпоративного контекста (compliance, аудиты) чаще выбирают GPT или Claude — у Alibaba другие юрисдикция и правила хранения данных. Актуальные версии Qwen, доступные через API-провайдеров, удобно смотреть в каталоге моделей; попробовать можно сразу в чате.
Частые вопросы
Qwen бесплатный?
Открытые модели бесплатны для скачивания и запуска. API-флагман Qwen3.8-Max платный: $2/$6 за миллион токенов. В чате chat.qwen.ai есть бесплатный доступ с лимитами.
Можно ли запустить Qwen у себя на компьютере?
Да, открытые версии от 0.6B до 27B параметров запускаются локально; 27B требует около 24 ГБ видеопамяти в 4-битном виде.
Почему Qwen так дёшев?
Архитектура MoE активирует малую часть параметров на каждый запрос, а Alibaba целенаправленно демпингует, борясь за долю рынка.
Qwen цензурирован?
На политических темах — заметно сильнее западных моделей. На технических и бытовых — отказы редкие.
Чем Qwen отличается от Kimi?
Обе — китайские модели с открытыми весами и низкими ценами. Kimi (Moonshot) обычно дороже и сильнее в агентных задачах, Qwen шире по линейке и лучше в русском. Подробности — в обзоре Kimi.