Модели
Gemini 4 Argon и Flash: что Google даёт за свои деньги
Gemini — семейство моделей Google DeepMind. Главные козыри линейки: огромные контекстные окна, честная мультимодальность (текст, изображения, аудио и видео в одном запросе) и агрессивные цены. В 2026 году флагманом стал Gemini 4 Argon, а рабочей лошадкой — Flash с контекстом до 10 миллионов токенов. Разбираем, что это даёт на практике.
Актуальные модели Gemini
Argon вышел 30 сентября 2026 года и необычен двумя вещами. Первая — окно вывода: до миллиона токенов за одну генерацию, против примерно 64 тысяч у предыдущего поколения. Google сделала ставку на «длинные траектории»: агентская задача, которая раньше требовала десятков вызовов, может уложиться в один. Вторая — доступ: модель сначала открыли не всем, а проверенным специалистам по киберзащите в рамках программы Fairwind, разработчикам и подписчикам AI Ultra — поэтапно, после проверки безопасности.
Flash — это про масштаб: 10 миллионов токенов контекста за $0.15 за миллион. Это значит, что кодовая база на полмиллиона строк или час видео влезают в один запрос целиком.
| Модель | Контекст | Цена за 1 млн токенов |
|---|---|---|
| Gemini 4 Argon (флагман) | 1 млн вход / до 1 млн выход | $2 вход / $10 выход на старте, потом $4 / $20 |
| Gemini 4.0 Flash | до 10 млн токенов | $0.15 вход / $0.60 выход |
| Gemini 3.x (прошлое поколение) | до 2 млн токенов | дешевле, но уступает по качеству |
Насколько это умно
На бенчмарках Argon держит уровень топовых флагманов: сильные результаты в реальной разработке (DeepSWE), агентной автоматизации и понимании длинного видео. Отдельная заявка — работа с кодом на 800 тысяч строк: не фрагментами, а как единым проектом.
Мультимодальность — историческое преимущество Gemini. Модель принимает изображения, аудио и видео до нескольких часов без конвертации в текст. Для анализа записей встреч, лекций, скриншотов интерфейсов это работает «из коробки», тогда как у многих конкурентов видео либо не принимается, либо режется до минут.
Безопасность и отказы
Google с Argon пошла по пути «сначала защита, потом доступ»: публичный релиз шёл волнами и к моменту чтения этой статьи доступность могла отличаться от заявленной. Часть тем (кибератаки, вредоносный контент) закрыта фильтрами на нескольких уровнях — модели, сервиса и региональных правил, поэтому поведение может отличаться даже для одного аккаунта.
Отказы на бытовых запросах редкие. Особенность именно Gemini — строгая модерация в API по умолчанию: фильтры безопасности настраиваются отдельно, и на высоких уровнях блокировки модель может резать безобидные ответы. Если ответы «обрываются», проверьте настройки safety settings.
Сколько стоит задача
Цены Gemini традиционно самые низкие на рынке за токен. Практическая математика: запрос на 10 млн токенов входа у Flash стоит около $1.50 — у конкурентов на сопоставимом контексте счёт идёт на десятки долларов. Для Argon на вводном этапе кэшированный вход дешевле ещё на 5–95% в зависимости от сценария.
Что важно понимать: дешёвый вход не равен дешёвой задаче. Если модель генерирует длинные ответы, платите за выход — а у Flash выход в четыре раза дороже входа. Агентные сценарии с циклами «прочитал — подумал — ответил» съедают бюджет именно на повторных чтениях, поэтому кэширование критично.
Особенности работы
- До 10 млн токенов контекста у Flash — но качество удержания деталей в самом конце окна всё равно проверяйте на своей задаче.
- Нативные вызовы инструментов (MCP-совместимые) прямо в модели — меньше обвязки для агентов.
- Встроенные инструменты Google: поиск, карты, исполнение кода, контекст по URL.
- Мультимодальность: до 3 часов видео в одном запросе у Flash.
- Ограничение: доступ к флагману Argon поэтапный; в потребительском приложении не все режимы доступны сразу.
Кому подходит
Gemini — лучший выбор, если задача про большие объёмы данных: анализ видеозаписей, огромные документы, целые репозитории. Также это разумный дефолт по цене, если качество топ-моделей избыточно для вашей рутины.
Для чистого кода и аккуратного письма многие предпочитают Claude или GPT — Gemini сильнее там, где нужны мультимодальность и масштаб. Самый надёжный способ выбрать — прогнать один и тот же запрос через обе модели: например, в чате ANY LLM модель переключается перед каждым вопросом.
Частые вопросы
Gemini бесплатный?
Да, есть бесплатный доступ в приложении Gemini и лимиты в AI Studio. Полноценная работа с большими контекстами и флагманом — платная.
10 миллионов токенов — это сколько?
Примерно 7–8 миллионов слов или сотни средних книг. На практике — большая кодовая база или многочасовое видео целиком.
Почему Gemini мне отказывает чаще, чем другие модели?
Скорее всего, сработали настройки безопасности в API или региональные правила. Проверьте safety settings и формулировку запроса.
Argon доступен всем?
Нет, релиз поэтапный: сначала специалисты по безопасности и подписчики Ultra, потом остальные. Проверяйте актуальный статус на страницах Google.
Что выбрать: Gemini Flash или GPT Luna?
Обе модели для объёмной рутины. Flash выигрывает по контексту и мультимодальности, Luna — по цене на простые текстовые задачи.