Gemma 4 26B A4B

ТекстПлатнаяДоступна

Релиз: 3 апреля 2026 г.

Инструктивно-настроенная MoE-модель Google DeepMind: 25,2B параметров, 3,8B активных. Мультимодальная, Apache 2.0.

Вход: 17 искр/1M токенов модели · Выход: 82 искр/1M токенов модели

Gemma 4 26B A4B IT — инструктивно-настроенная (instruction-tuned) MoE-модель от Google DeepMind, выпущенная под лицензией Apache 2.0. Несмотря на 25,2B总 параметров, во время вывода активируется только 3,8B на токен, обеспечивая качество, близкое к 31B, при значительно меньших вычислительных затратах.

Поддерживает мультимодальный ввод, включая текст, изображения и видео (до 60 секунд с частотой 1 кадр в секунду). Особенности модели: контекстное окно на 256K токенов, нативный вызов функций, настраиваемый режим мышления/рассуждений и поддержка структурированного вывода.

Ключевые характеристики:

  • MoE архитектура: 25,2B параметров, 3,8B активных
  • Open-weight: Лицензия Apache 2.0
  • Мультимодальность: Текст, изображения, видео (до 60 сек)
  • Большой контекст: 256K токенов
  • Нативный function calling: Встроенная поддержка инструментов
  • Настраиваемые рассуждения: Режим thinking/reasoning
  • Структурированный вывод: Гарантированные форматы ответов

Идеально подходит для:

  • Самостоятельного развёртывания (self-hosting)
  • Мультимодальных приложений с видео
  • Агентных рабочих процессов
  • Исследовательских задач
  • Экономичных production-систем

Тарификация:

  • Вход: 17 Искр за 1M токенов
  • Выход: 82 Искры за 1M токенов

Дата релиза: 3 апреля 2026 г.