Mistral Small 3

ТекстПлатнаяДоступна

24B модель с низкой задержкой, производительностью как Llama 3.3 70B при тройной скорости. Apache 2.0, локальное развёртывание.

Вход: 12 искр/1M токенов модели · Выход: 19 искр/1M токенов модели

Mistral Small 3 — 24B языковая модель, оптимизированная для низкой задержки на типовых AI-задачах. Достигает 81% на MMLU, производительность сравнима с Llama 3.3 70B и Qwen 32B при тройной скорости на том же оборудовании. Распространяется под лицензией Apache 2.0. Контекстное окно 33K токенов.

Ключевые характеристики:81% MMLU: Высокая производительность. • Тройная скорость: Быстрее аналогов на том же железе. • Apache 2.0: Свободная лицензия. • Локальный деплой: Оптимизирована для локального развёртывания.

Идеально подходит для: • Локального развёртывания. • Edge-вычислений. • Экономичного инференса.

Дата релиза: 30 января 2025 г.