Gemini 2.5 Flash Lite

ТекстПлатнаяДоступна

Релиз: 22 июля 2025 г.

Лёгкая модель рассуждений Google для ультра-низкой задержки и экономичности. 1M контекста, опциональное thinking.

Вход: 24 искр/1M токенов модели · Выход: 96 искр/1M токенов модели

Gemini 2.5 Flash Lite — лёгкая модель рассуждений в семействе Gemini 2.5, оптимизированная для ультра-низкой задержки и экономической эффективности. Модель предлагает улучшенную пропускную способность, более быструю генерацию токенов и лучшую производительность на стандартных бенчмарках по сравнению с более ранними Flash-моделями.

По умолчанию "thinking" (многопроходные рассуждения) отключён для приоритета скорости, но разработчики могут включить его через параметр Reasoning API, чтобы выборочно обменивать стоимость на интеллект. Модель поддерживает мультимодальный ввод с контекстным окном в 1M токенов.

Ключевые характеристики:

  • Лёгкая модель рассуждений: Оптимизирована для скорости
  • Ультра-низкая задержка: Максимальная отзывчивость
  • Экономичность: Низкая стоимость для высоких нагрузок
  • Thinking off by default: Скорость в приоритете
  • Опциональные рассуждения: Включение через Reasoning API
  • 1M контекст: С мультимодальной поддержкой
  • Огромная нагрузка: 604B токенов в неделю

Идеально подходит для:

  • Высоконагруженных систем с критичной задержкой
  • Экономичных масштабных внедрений
  • Быстрой обработки больших объёмов
  • Сценариев, где скорость важнее глубины
  • Real-time приложений

Тарификация:

  • Вход: 24 Искры за 1M токенов
  • Выход: 96 Искр за 1M токенов

Дата релиза: 22 июля 2025 г.