Qwen3.5-Flash

ТекстПлатнаяДоступна

Релиз: 26 февраля 2026 г.

Быстрая нативная визуально-языковая модель Qwen: гибридная архитектура (линейное внимание + sparse MoE), 1M контекста.

Вход: 24 искр/1M токенов модели · Выход: 96 искр/1M токенов модели

Qwen3.5 Flash — нативная визуально-языковая модель из семейства Flash, построенная на гибридной архитектуре, объединяющей механизм линейного внимания с разреженной моделью Mixture-of-Experts, обеспечивая более высокую эффективность вывода. По сравнению с серией 3, эти модели демонстрируют значительный скачок в производительности как для текстовых, так и для мультимодальных задач, предлагая быстрое время ответа при балансе скорости вывода и общей производительности.

Модель поддерживает мультимодальный ввод: текст, изображения и видео с огромным контекстным окном в 1M токенов, что позволяет обрабатывать длинные мультимодальные сценарии с высокой эффективностью.

Ключевые характеристики:

  • Flash серия: Быстрые ответы, высокая эффективность
  • Гибридная архитектура: Линейное внимание + sparse MoE
  • Мультимодальность: Текст, изображения, видео на входе
  • Огромный контекст: 1M токенов
  • Скачок производительности: Значительно лучше серии 3
  • Баланс скорости и качества: Оптимальное соотношение

Идеально подходит для:

  • Высоконагруженных приложений реального времени
  • Мультимодальных задач с критичной задержкой
  • Экономичных масштабных внедрений
  • Быстрой обработки длинных контекстов
  • Чат-систем и ассистентов

Тарификация:

  • Вход: 24 Искры за 1M токенов
  • Выход: 96 Искр за 1M токенов

Дата релиза: 26 февраля 2026 г.