Qwen3 235B A22B Instruct 2507

ТекстПлатнаяДоступна

Релиз: 21 июля 2025 г.

Многоязычная инструкционная MoE-модель Qwen: 235B параметров, 22B активных, 262K контекста, сильна в математике и кодинге.

Вход: 18 искр/1M токенов модели · Выход: 24 искр/1M токенов модели

Qwen3-235B-A22B-Instruct-2507 — многоязычная инструкционно-настроенная модель Mixture-of-Experts на архитектуре Qwen3-235B с 22B активных параметров за проход. Модель оптимизирована для текстовой генерации общего назначения, включая следование инструкциям, логические рассуждения, математику, программирование и использование инструментов. Поддерживает нативный контекст на 262K токенов и не реализует "thinking mode" (блоки <think>).

По сравнению с базовым вариантом, эта версия демонстрирует значительные улучшения в покрытии знаний, длинноконтекстных рассуждениях, бенчмарках программирования и выравнивании с открытыми задачами. Модель особенно сильна в многоязычном понимании, математических рассуждениях (например, AIME, HMMT) и оценках выравнивания, таких как Arena-Hard и WritingBench.

Ключевые характеристики:

  • MoE архитектура: 235B параметров, 22B активных
  • Многоязычная: Широкая языковая поддержка
  • 262K контекст: Для длинных документов
  • No thinking mode: Прямые ответы без <think>
  • Математика: Сильные результаты на AIME, HMMT
  • Программирование: Улучшенные кодинг-бенчмарки
  • Выравнивание: Высокие оценки на Arena-Hard, WritingBench

Идеально подходит для:

  • Многоязычных инструкционных задач
  • Математических рассуждений
  • Длинноконтекстных сценариев
  • Программирования и tool use
  • Задач с открытыми ответами

Тарификация:

  • Вход: 18 Искр за 1M токенов
  • Выход: 24 Искры за 1M токенов

Дата релиза: 21 июля 2025 г.