Qwen3.5 Flash — нативная визуально-языковая модель из семейства Flash, построенная на гибридной архитектуре, объединяющей механизм линейного внимания с разреженной моделью Mixture-of-Experts, обеспечивая более высокую эффективность вывода. По сравнению с серией 3, эти модели демонстрируют значительный скачок в производительности как для текстовых, так и для мультимодальных задач, предлагая быстрое время ответа при балансе скорости вывода и общей производительности.
Модель поддерживает мультимодальный ввод: текст, изображения и видео с огромным контекстным окном в 1M токенов, что позволяет обрабатывать длинные мультимодальные сценарии с высокой эффективностью.
Ключевые характеристики:
- Flash серия: Быстрые ответы, высокая эффективность
- Гибридная архитектура: Линейное внимание + sparse MoE
- Мультимодальность: Текст, изображения, видео на входе
- Огромный контекст: 1M токенов
- Скачок производительности: Значительно лучше серии 3
- Баланс скорости и качества: Оптимальное соотношение
Идеально подходит для:
- Высоконагруженных приложений реального времени
- Мультимодальных задач с критичной задержкой
- Экономичных масштабных внедрений
- Быстрой обработки длинных контекстов
- Чат-систем и ассистентов
Тарификация:
- Вход: 24 Искры за 1M токенов
- Выход: 96 Искр за 1M токенов
Дата релиза: 26 февраля 2026 г.