Google представила Gemini 3.6 Flash: модель использует на 17% меньше output-токенов, чем 3.5 Flash, и стоит дешевле. В задачах программирования она показывает более высокую точность и меньше лишних правок кода.

Google представила Gemini 3.6 Flash — обновление лёгкой флагманской модели. По сравнению с 3.5 Flash, она использует на 17% меньше output-токенов по Artificial Analysis Index, а на некоторых бенчмарках сокращение достигает 65%. В многошаговых агентных сценариях модель делает меньше шагов рассуждения и вызовов инструментов. Также снижена стоимость: $1.50 за миллион input-токенов и $7.50 за output-токенов против $9 у 3.5 Flash. В задачах кодинга модель показывает более высокую точность, меньше лишних правок и зацикливаний. Gemini 3.6 Flash уже доступна в приложении Gemini, AI Studio и Vertex AI.

Источники 1
  • Google выпустила Gemini 3.6 Flash — более дешёвую и эффективную модель AI Product | Igor Akimov
    Google выкатил три новых Gemini: 3.6 Flash, 3.5 Flash-Lite и 3.5 Flash Cyber
    
    Пока все ждут 3.5 Pro (который задерживается – по слухам, из-за слабых результатов на кодинговых бенчмарках), Google усиливает свою «рабочую лошадку» – линейку Flash.
    
    Gemini 3.6 Flash – главный релиз:
    – на 17% меньше output-токенов по сравнению с 3.5 Flash (по Artificial Analysis Index), а на некоторых бенчмарках вроде DeepSWE – до 65%
    – меньше шагов рассуждения и tool calls в многошаговых агентных сценариях
    – цена ниже предшественника: $1.50 за миллион input-токенов и $7.50 за output (у 3.5 Flash было $9 за output)
    – в кодинге – выше точность, меньше лишних правок кода и зацикливаний
    – расширенные Frontier Safety-механизмы
    
    Gemini 3.5 Flash-Lite:
    – самая быстрая и дешевая модель класса 3.5: 350 output-токенов в секунду
    – $0.30 за миллион input и $2.50 за output – для высоконагруженных задач вроде перевода и модерации
    – обгоняет 3 Flash: SWE-Bench Pro 54.2% vs 49.6%, OSWorld-Verified 74.0% vs 65.1%
    
    Gemini 3.5 Flash Cyber – самое интересное:
    – специализированная модель для поиска, валидации и патчинга уязвимостей, построенная поверх 3.5 Flash
    – на V8 JavaScript Engine нашла 55 уникальных подтвержденных проблем против 47 у 3.5 Flash и 36 у Claude Opus 4.6
    – доступ – только правительствам и доверенным партнерам через CodeMender в рамках ограниченного пилота
    – логика: дешевая и быстрая модель, которую агент может вызывать многократно, покрывая больше путей в коде 
    
    3.6 Flash и 3.5 Flash-Lite уже доступны в приложении Gemini и в AI Studio / Vertex AI. 
    
    В целом гугловские модели - отличные рабочие лошадки, много где использую, надо обновляться с 3 и 3.5-flash
    
    https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber/