Google выпустил Gemini 3.1 Flash-Lite - быстрый и дешёвый ИИ для массовых задач
Google представил Gemini 3.1 Flash-Lite - модель для разработчиков, которая работает в 2.5 раза быстрее предшественника и стоит от $0.25 за миллион токенов.
Google запустил Gemini 3.1 Flash-Lite - очередную модель в своей линейке ИИ, на этот раз заточенную под скорость и экономию. Целевая аудитория понятна: разработчики и компании, которым нужно обрабатывать огромные объёмы данных без разорительных счетов.
Модель доступна в превью через Gemini API в Google AI Studio, а корпоративные клиенты могут попробовать её через Vertex AI. Ценник выглядит привлекательно: $0.25 за миллион входных токенов и $1.50 за миллион выходных. Для тех, кто гоняет терабайты текста ежедневно, это может быть существенной экономией.

Что касается производительности - Google обещает, что Flash-Lite выдаёт первый токен ответа в 2.5 раза быстрее, чем Gemini 2.5 Flash, а общая скорость генерации выросла на 45%. При этом качество, судя по бенчмаркам, не просело: модель набрала 1432 балла по Elo на Arena.ai, показала 86.9% на GPQA Diamond и 76.8% на MMMU Pro.
Интересная фишка - возможность управлять глубиной рассуждений модели. Это позволяет балансировать между скоростью и качеством в зависимости от задачи. Модель поддерживает мультимодальность и подходит для перевода, модерации контента, анализа данных и прочих рутинных, но требовательных задач.
Первые пользователи из компаний вроде Latitude, Cartwheel и Whering отмечают, что Flash-Lite справляется со сложными запросами на уровне, который обычно ожидаешь от более дорогих моделей. Если это не маркетинговая лакировка, то звучит неплохо.

В общем, Google продолжает штамповать варианты Gemini под разные сценарии использования. Flash-Lite - это ставка на массовость: быстро, дёшево и достаточно качественно для большинства прикладных задач.
Смотрите также
-
Чат-боты·GPT-5.6: обзор нового семейства OpenAI – Sol, Terra и Luna, и какую модель выбрать
-
Чат-боты·Режим goal (/goal) в OpenAI Codex – как реально включить и работать с автономным агентом
-
Чат-боты·OpenAI запускает закрытый превью-доступ к GPT-5.6 Sol для избранных партнёров
-
Ассистенты·Журналист попробовал новую функцию Scheduled Tasks в ChatGPT — и счёл её самым близким к настоящему ИИ-ассистенту
-
Чат-боты·Gemini от Google в 2026 году: что умеет и как пользоваться из России
-
Чат-боты·OpenAI готовит к запуску семейство моделей GPT-5.6 с новыми версиями Mini и Pro
-
Чат-боты·Claude требует паспорт и селфи: что проверяют и что это значит для россиян
-
Чат-боты·Claude Fable 5 и Claude Mythos 5: самые мощные модели Anthropic вышли в общий доступ
-
Чат-боты·Lockdown Mode и метки Elevated Risk в ChatGPT: новые инструменты защиты