Google представила модель Gemini 3.8 Flash: больше размышлений, но цена может вырасти
Компания Google запустила новую версию языковой модели Gemini 3.8 Flash, заявляя о её повышенной способности к выполнению сложных логических задач. Новинка способна выполнять больше шагов рассуждения и использовать инструменты итеративно. Однако, несмотря на идентичный старту стоимости с предшественником, Google предупреждает, что увеличение вычислительной нагрузки может привести к более высокому расходу токенов, что в конечном итоге удорожит использование модели для разработчиков и энтерпрайз-клиентов.

# Google представляет Gemini 3.8 Flash: шаг вперед в логике, но риск для бюджета
Технологический гигант Google анонсировал выход новой версии своей языковой модели — Gemini 3.8 Flash. Объявление было сделано всего через несколько недель после релиза предыдущей версии, модели 3.7 Flash, что подчеркивает агрессивный ритм обновлений в текущем цикле развития нейросетей компании.
Ключевым заявлением разработчиков стала фраза о том, что новая версия «работает усерднее» (*works harder*). По сути, это означает способность модели к более глубокому анализу данных.
Больше шагов рассуждений и инструментов
Согласно официальным заявлениям, Gemini 3.8 Flash превосходит своего предшественника за счет выполнения большего количества шагов при решении сложных задач. Модель теперь способна «вызывать инструменты итеративно», что означает, что она может самостоятельно инициировать цепочки действий с внешними сервисами или кодами, чтобы решить проблему, а не ограничиваться одним статичным ответом.
Показатели эффективности были проверены на ряде специализированных бенчмарков. Новая модель продемонстрировала превосходство над предыдущей версией, а также конкурирующими моделями других компаний, таких как Anthropic (модель Fable 5). Успехи зафиксированы в таких областях, как программная инженерия (DeepSWE v1.1), финансы (Vals Finance Agent V2) и юридический анализ (Harvey's Legal Agent benchmark).
Для разработчиков это открывает новые возможности. Эксперты, такие как Джон Эннис, руководитель Aigora.ai, отмечают, что модель предлагает качество кода, сопоставимое с топовыми продуктами вроде Opus 5 от Anthropic, но при значительно более низкой стоимости. Это делает её привлекательным инструментом для создания автономных агентов, включая генерацию видео для форматов вроде Remotion.
Фактор стоимости и расход токенов
С экономической точки зрения ситуация требует внимания. Введение модели 3.8 Flash произошло при сохранении введенной ранее ценовой политики для новых пользователей: * Входные токены: $0,75 за миллион. * Выходные токены: $3,75 за миллион.
Однако Google прямо предупреждает, что итоговая стоимость для пользователя может вырасти. Причина кроется в самой архитектуре работы модели. Чтобы обеспечить заявленный уровень «усердия» и глубину рассуждений, модель потребляет больше ресурсов на генерацию ответа.
Анализ от Artificial Analysis показал, что, несмотря на неизменную цену за один токен, общее количество выходных токенов на одну задачу выросло примерно на 30% по сравнению с 3.7 Flash. Кроме того, в процессе агентского тестирования модель совершает на 40% больше ходов. Это означает, что даже при той же ставке за символ, конечный счет будет выше из-за большего объема обработанной генерации.
Что такое токены?
Для тех, кто не работает с кодом ежедневно, важно понять понятие «токены». Это условные единицы измерения информации для нейросетей. Один токен может соответствовать одной букве или половине слова в зависимости от языка. Когда вы просите модель написать статью, она генерирует её кусочками (токенами), и за каждый такой кусочек компания берет плату. Больше токенов — выше счет.
В связи с этим, Google оставляет возможность для оптимизации затрат: разработчики могут продолжать использовать более старую модель 3.7 Flash, если их приоритетом является минимизация расхода токенов и снижение бюджета проекта.
Безопасность и специальные версии
Важной частью обновления стал аспект безопасности. Модель оснащена усиленными механизмами защиты от злоупотреблений в чувствительных сферах, включая химическую, биологическую, радиологическую и ядерную (CBRN) области, а также в сфере кибероффенсивных (нападение на инфраструктуру) операций.
Параллельно с гражданским релизом, Google анонсировал запуск специальной версии «Gemini 3.8 Flash Cyber». Это решение выделено в отдельную программу «Fairwind», доступную исключительно правительствам и проверенным партнерам (к которым относятся крупные кибербезопасные компании вроде CrowdStrike). Программа обеспечивает доступ к защищенной версии модели и агенту CodeMender, способному автономно обнаруживать и устранять уязвимости в критической инфраструктуре.
Модель Gemini 3.8 Flash уже доступна для использования потребителям с подписками Google AI Pro или Ultra, а также разработчикам и корпоративным клиентам.