Новость
Google выпустила Gemini 3.5 Flash-Lite — самую быструю и дешёвую модель в линейке 3.5
Gemini 3.5 Flash-Lite генерирует 350 output-токенов в секунду и стоит $0.30 за миллион input-токенов. Модель рассчитана на высоконагруженные задачи, включая перевод и модерацию.
Google анонсировала Gemini 3.5 Flash-Lite — самую быструю и дешёвую модель в линейке 3.5. Она генерирует 350 output-токенов в секунду. Стоимость составляет $0.30 за миллион input-токенов и $2.50 за output-токенов, что делает модель подходящей для высоконагруженных задач, например перевода и модерации. По сравнению с предшественником 3 Flash модель показывает улучшения на SWE-Bench Pro и OSWorld-Verified. Gemini 3.5 Flash-Lite уже доступна в приложении Gemini, AI Studio и Vertex AI.
Источники
1
-
Google выпустила Gemini 3.5 Flash-Lite — самую быструю и дешёвую модель в линейке 3.5
AI Product | Igor Akimov
Google выкатил три новых Gemini: 3.6 Flash, 3.5 Flash-Lite и 3.5 Flash Cyber Пока все ждут 3.5 Pro (который задерживается – по слухам, из-за слабых результатов на кодинговых бенчмарках), Google усиливает свою «рабочую лошадку» – линейку Flash. Gemini 3.6 Flash – главный релиз: – на 17% меньше output-токенов по сравнению с 3.5 Flash (по Artificial Analysis Index), а на некоторых бенчмарках вроде DeepSWE – до 65% – меньше шагов рассуждения и tool calls в многошаговых агентных сценариях – цена ниже предшественника: $1.50 за миллион input-токенов и $7.50 за output (у 3.5 Flash было $9 за output) – в кодинге – выше точность, меньше лишних правок кода и зацикливаний – расширенные Frontier Safety-механизмы Gemini 3.5 Flash-Lite: – самая быстрая и дешевая модель класса 3.5: 350 output-токенов в секунду – $0.30 за миллион input и $2.50 за output – для высоконагруженных задач вроде перевода и модерации – обгоняет 3 Flash: SWE-Bench Pro 54.2% vs 49.6%, OSWorld-Verified 74.0% vs 65.1% Gemini 3.5 Flash Cyber – самое интересное: – специализированная модель для поиска, валидации и патчинга уязвимостей, построенная поверх 3.5 Flash – на V8 JavaScript Engine нашла 55 уникальных подтвержденных проблем против 47 у 3.5 Flash и 36 у Claude Opus 4.6 – доступ – только правительствам и доверенным партнерам через CodeMender в рамках ограниченного пилота – логика: дешевая и быстрая модель, которую агент может вызывать многократно, покрывая больше путей в коде 3.6 Flash и 3.5 Flash-Lite уже доступны в приложении Gemini и в AI Studio / Vertex AI. В целом гугловские модели - отличные рабочие лошадки, много где использую, надо обновляться с 3 и 3.5-flash https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-6-flash-3-5-flash-lite-3-5-flash-cyber/