Gemini 2.5 Flash Lite — лёгкая модель рассуждений в семействе Gemini 2.5, оптимизированная для ультра-низкой задержки и экономической эффективности. Модель предлагает улучшенную пропускную способность, более быструю генерацию токенов и лучшую производительность на стандартных бенчмарках по сравнению с более ранними Flash-моделями.
По умолчанию "thinking" (многопроходные рассуждения) отключён для приоритета скорости, но разработчики могут включить его через параметр Reasoning API, чтобы выборочно обменивать стоимость на интеллект. Модель поддерживает мультимодальный ввод с контекстным окном в 1M токенов.
Ключевые характеристики:
- Лёгкая модель рассуждений: Оптимизирована для скорости
- Ультра-низкая задержка: Максимальная отзывчивость
- Экономичность: Низкая стоимость для высоких нагрузок
- Thinking off by default: Скорость в приоритете
- Опциональные рассуждения: Включение через Reasoning API
- 1M контекст: С мультимодальной поддержкой
- Огромная нагрузка: 604B токенов в неделю
Идеально подходит для:
- Высоконагруженных систем с критичной задержкой
- Экономичных масштабных внедрений
- Быстрой обработки больших объёмов
- Сценариев, где скорость важнее глубины
- Real-time приложений
Тарификация:
- Вход: 24 Искры за 1M токенов
- Выход: 96 Искр за 1M токенов
Дата релиза: 22 июля 2025 г.