DeepSeek V3.2

ТекстПлатнаяДоступна

Релиз: 1 декабря 2025 г.

Модель DeepSeek с гибридом эффективности и мощности: DSA для длинных контекстов, золото на IMO и IOI 2025.

Вход: 61 искр/1M токенов модели · Выход: 91 искр/1M токенов модели

DeepSeek V3.2 — большая языковая модель, разработанная для гармонизации высокой вычислительной эффективности с сильными рассуждениями и агентным использованием инструментов. Модель внедряет DeepSeek Sparse Attention (DSA), механизм мелкозернистого разреженного внимания, который снижает стоимость обучения и вывода, сохраняя качество в сценариях с длинными контекстами.

Масштабируемая пост-тренировочная структура обучения с подкреплением дополнительно улучшает рассуждения, обеспечивая производительность на уровне GPT-5. Модель продемонстрировала результаты золотого уровня на IMO и IOI 2025. V3.2 также использует крупномасштабный пайплайн синтеза агентных задач для лучшей интеграции рассуждений в сценарии использования инструментов, повышая соблюдение инструкций и обобщение в интерактивных средах.

Ключевые характеристики:

  • DSA архитектура: DeepSeek Sparse Attention для экономии
  • Производительность GPT-5: На уровне флагманских моделей
  • Золото на IMO/IOI 2025: Лучшие результаты в математике и информатике
  • Масштабируемый RL: Пост-тренировочное обучение с подкреплением
  • Агентный пайплайн: Улучшенная интеграция рассуждений в tool-use
  • Контроль рассуждений: Параметр reasoning enabled
  • Огромная нагрузка: 1,15T токенов в неделю

Идеально подходит для:

  • Длинных контекстных сценариев
  • Агентных систем с использованием инструментов
  • Математических и алгоритмических задач
  • Интерактивных сред
  • Задач, требующих эффективных рассуждений

Тарификация:

  • Вход: 61 Искра за 1M токенов
  • Выход: 91 Искра за 1M токенов

Дата релиза: 1 декабря 2025 г.