Модели

Gemini 4 Argon и Flash: что Google даёт за свои деньги

Gemini — семейство моделей Google DeepMind. Главные козыри линейки: огромные контекстные окна, честная мультимодальность (текст, изображения, аудио и видео в одном запросе) и агрессивные цены. В 2026 году флагманом стал Gemini 4 Argon, а рабочей лошадкой — Flash с контекстом до 10 миллионов токенов. Разбираем, что это даёт на практике.

Актуальные модели Gemini

Argon вышел 30 сентября 2026 года и необычен двумя вещами. Первая — окно вывода: до миллиона токенов за одну генерацию, против примерно 64 тысяч у предыдущего поколения. Google сделала ставку на «длинные траектории»: агентская задача, которая раньше требовала десятков вызовов, может уложиться в один. Вторая — доступ: модель сначала открыли не всем, а проверенным специалистам по киберзащите в рамках программы Fairwind, разработчикам и подписчикам AI Ultra — поэтапно, после проверки безопасности.

Flash — это про масштаб: 10 миллионов токенов контекста за $0.15 за миллион. Это значит, что кодовая база на полмиллиона строк или час видео влезают в один запрос целиком.

МодельКонтекстЦена за 1 млн токенов
Gemini 4 Argon (флагман)1 млн вход / до 1 млн выход$2 вход / $10 выход на старте, потом $4 / $20
Gemini 4.0 Flashдо 10 млн токенов$0.15 вход / $0.60 выход
Gemini 3.x (прошлое поколение)до 2 млн токеновдешевле, но уступает по качеству

Насколько это умно

На бенчмарках Argon держит уровень топовых флагманов: сильные результаты в реальной разработке (DeepSWE), агентной автоматизации и понимании длинного видео. Отдельная заявка — работа с кодом на 800 тысяч строк: не фрагментами, а как единым проектом.

Мультимодальность — историческое преимущество Gemini. Модель принимает изображения, аудио и видео до нескольких часов без конвертации в текст. Для анализа записей встреч, лекций, скриншотов интерфейсов это работает «из коробки», тогда как у многих конкурентов видео либо не принимается, либо режется до минут.

Безопасность и отказы

Google с Argon пошла по пути «сначала защита, потом доступ»: публичный релиз шёл волнами и к моменту чтения этой статьи доступность могла отличаться от заявленной. Часть тем (кибератаки, вредоносный контент) закрыта фильтрами на нескольких уровнях — модели, сервиса и региональных правил, поэтому поведение может отличаться даже для одного аккаунта.

Отказы на бытовых запросах редкие. Особенность именно Gemini — строгая модерация в API по умолчанию: фильтры безопасности настраиваются отдельно, и на высоких уровнях блокировки модель может резать безобидные ответы. Если ответы «обрываются», проверьте настройки safety settings.

Сколько стоит задача

Цены Gemini традиционно самые низкие на рынке за токен. Практическая математика: запрос на 10 млн токенов входа у Flash стоит около $1.50 — у конкурентов на сопоставимом контексте счёт идёт на десятки долларов. Для Argon на вводном этапе кэшированный вход дешевле ещё на 5–95% в зависимости от сценария.

Что важно понимать: дешёвый вход не равен дешёвой задаче. Если модель генерирует длинные ответы, платите за выход — а у Flash выход в четыре раза дороже входа. Агентные сценарии с циклами «прочитал — подумал — ответил» съедают бюджет именно на повторных чтениях, поэтому кэширование критично.

Особенности работы

  • До 10 млн токенов контекста у Flash — но качество удержания деталей в самом конце окна всё равно проверяйте на своей задаче.
  • Нативные вызовы инструментов (MCP-совместимые) прямо в модели — меньше обвязки для агентов.
  • Встроенные инструменты Google: поиск, карты, исполнение кода, контекст по URL.
  • Мультимодальность: до 3 часов видео в одном запросе у Flash.
  • Ограничение: доступ к флагману Argon поэтапный; в потребительском приложении не все режимы доступны сразу.

Кому подходит

Gemini — лучший выбор, если задача про большие объёмы данных: анализ видеозаписей, огромные документы, целые репозитории. Также это разумный дефолт по цене, если качество топ-моделей избыточно для вашей рутины.

Для чистого кода и аккуратного письма многие предпочитают Claude или GPT — Gemini сильнее там, где нужны мультимодальность и масштаб. Самый надёжный способ выбрать — прогнать один и тот же запрос через обе модели: например, в чате ANY LLM модель переключается перед каждым вопросом.

Частые вопросы

Gemini бесплатный?

Да, есть бесплатный доступ в приложении Gemini и лимиты в AI Studio. Полноценная работа с большими контекстами и флагманом — платная.

10 миллионов токенов — это сколько?

Примерно 7–8 миллионов слов или сотни средних книг. На практике — большая кодовая база или многочасовое видео целиком.

Почему Gemini мне отказывает чаще, чем другие модели?

Скорее всего, сработали настройки безопасности в API или региональные правила. Проверьте safety settings и формулировку запроса.

Argon доступен всем?

Нет, релиз поэтапный: сначала специалисты по безопасности и подписчики Ultra, потом остальные. Проверяйте актуальный статус на страницах Google.

Что выбрать: Gemini Flash или GPT Luna?

Обе модели для объёмной рутины. Flash выигрывает по контексту и мультимодальности, Luna — по цене на простые текстовые задачи.

Источники

Как мы проверяем материалы

Читайте также