Модели

Qwen3.8-Max и открытые версии Qwen: что выбрать для работы на русском

Qwen — семейство моделей Alibaba и, пожалуй, главная альтернатива западным флагманам по цене. В 2026 году актуален Qwen3.8-Max — модель с 2,4 триллиона параметров и окном в миллион токенов за $2/$6, плюс открытые версии, которые можно запустить у себя. Разбираем линейку, лицензии (тут есть подводные камни) и то, что Qwen умеет по-русски.

Актуальные модели Qwen

Qwen3.8-Max вышел в августе 2026 года после презентации на конференции WAIC в Шанхае. Название скрывает необычную конструкцию: MoE (mixture-of-experts) с 2,4 триллионами параметров, из которых активны лишь около 95 миллиардов — поэтому цена за запрос не безумная, несмотря на размер.

Параллельно Alibaba выпускает открытые веса. Qwen3.8-27B — плотная модель, которая запускается на одной потребительской видеокарте с 24 ГБ памяти, и по заявлениям Alibaba конкурирует с гораздо более крупной Qwen3.7-Plus. Для локального запуска и изучения это сейчас один из лучших вариантов.

МодельЧто этоЦена / лицензия
Qwen3.8-MaxФлагман: 2,4 трлн параметров (MoE), 1M контекст, текст+видео$2 вход / $6 выход, закрытая API
Qwen3.8-27BОткрытая плотная модель, работает на одной видеокартеApache 2.0, бесплатно
Qwen3.8-Flash-NextПредварительный показ архитектуры будущей Qwen4Qwen Community License
Qwen3.5 / 3.6 / 3.7Прошлые поколения, ещё в строюApache 2.0 (открытые версии)

Насколько это умно

Флагман позиционируется для длинных агентных задач: многодневное автономное программирование, воспроизведение исследований, оркестрация нескольких агентов. Качество русского языка — традиционно сильное место Qwen: модель обучалась в том числе на большом объёме русскоязычных данных, и в русскоязычных задачах она часто обходит западные модели того же ценового класса.

Qwen3.8-Max принимает видео и изображения нативно. Важная оговорка: открытая версия флагмана (2.4T-A95B) — только текст, мультимодальность осталась в закрытой API-версии.

Безопасность и отказы

Qwen обучается под китайское регулирование: политические темы фильтруются заметно жёстче, чем у западных моделей, и это распространяется и на открытые веса. На бытовых и рабочих задачах отказы редкие — модель, скорее, наоборот, склонна отвечать на широкий круг технических вопросов.

Открытые веса дают дополнительную степень контроля: можно запустить модель локально, убрать сервисный слой и не передавать данные третьей стороне. Но нельзя «перепрошить» то, чему модель научилась: базовые отказы на политических темах остаются на уровне весов.

Сколько стоит задача

$2/$6 за миллион токенов у флагмана — это уровень Grok и в 2,5–15 раз дешевле GPT Sol или Claude Fable. Кэш-чтения — $0.25. Для массовой обработки текста на русском Qwen часто даёт лучшее соотношение цены и качества на рынке.

Локальный запуск бесплатен, но требует оборудования: 27B в 4-битном квантовании занимает около 17 ГБ памяти — нужна видеокарта уровня 24 ГБ или Mac с достаточным объёмом unified memory. Если оборудования нет, проще взять API-версию или дешёвую модель у агрегатора.

Особенности работы

  • Контекст 262K токенов нативно, расширяется до 1 млн через YaRN у открытых моделей; у флагмана — 1M из коробки.
  • Thinking-режим включён по умолчанию у новых моделей, отключается на уровне запроса; есть контроль глубины рассуждения (reasoning_effort).
  • Лицензии различаются: Apache 2.0 у большинства открытых моделей, но у флагманских весов — собственная лицензия с условиями по выручке. Читайте лицензию до коммерческого использования.
  • Семейство разрослось: отдельные модели для кода (Qwen3-Coder), изображений (Qwen-Image), речи и даже вождения (Qwen-Drive).
  • Ограничение: обновления выходят очень часто — версии 3.5, 3.6, 3.7, 3.8 вышли в течение полугода, и ориентируться стоит на страницу моделей, а не на старые обзоры.

Кому подходит

Если задачи на русском языке и бюджет ограничен — Qwen первый кандидат: качество русского плюс низкая цена. Разработчикам интересны открытые веса: можно встраивать модель в свои продукты без расходов за токены. Qwen — не единственный китайский тяжеловес: у Moonshot AI со своим Kimi своя философия, и сравнение этих двух линеек полезно читать парами.

Для строго западного корпоративного контекста (compliance, аудиты) чаще выбирают GPT или Claude — у Alibaba другие юрисдикция и правила хранения данных. Актуальные версии Qwen, доступные через API-провайдеров, удобно смотреть в каталоге моделей; попробовать можно сразу в чате.

Частые вопросы

Qwen бесплатный?

Открытые модели бесплатны для скачивания и запуска. API-флагман Qwen3.8-Max платный: $2/$6 за миллион токенов. В чате chat.qwen.ai есть бесплатный доступ с лимитами.

Можно ли запустить Qwen у себя на компьютере?

Да, открытые версии от 0.6B до 27B параметров запускаются локально; 27B требует около 24 ГБ видеопамяти в 4-битном виде.

Почему Qwen так дёшев?

Архитектура MoE активирует малую часть параметров на каждый запрос, а Alibaba целенаправленно демпингует, борясь за долю рынка.

Qwen цензурирован?

На политических темах — заметно сильнее западных моделей. На технических и бытовых — отказы редкие.

Чем Qwen отличается от Kimi?

Обе — китайские модели с открытыми весами и низкими ценами. Kimi (Moonshot) обычно дороже и сильнее в агентных задачах, Qwen шире по линейке и лучше в русском. Подробности — в обзоре Kimi.

Источники

Как мы проверяем материалы

Читайте также