DeepSeek V3.2 — большая языковая модель, разработанная для гармонизации высокой вычислительной эффективности с сильными рассуждениями и агентным использованием инструментов. Модель внедряет DeepSeek Sparse Attention (DSA), механизм мелкозернистого разреженного внимания, который снижает стоимость обучения и вывода, сохраняя качество в сценариях с длинными контекстами.
Масштабируемая пост-тренировочная структура обучения с подкреплением дополнительно улучшает рассуждения, обеспечивая производительность на уровне GPT-5. Модель продемонстрировала результаты золотого уровня на IMO и IOI 2025. V3.2 также использует крупномасштабный пайплайн синтеза агентных задач для лучшей интеграции рассуждений в сценарии использования инструментов, повышая соблюдение инструкций и обобщение в интерактивных средах.
Ключевые характеристики:
- DSA архитектура: DeepSeek Sparse Attention для экономии
- Производительность GPT-5: На уровне флагманских моделей
- Золото на IMO/IOI 2025: Лучшие результаты в математике и информатике
- Масштабируемый RL: Пост-тренировочное обучение с подкреплением
- Агентный пайплайн: Улучшенная интеграция рассуждений в tool-use
- Контроль рассуждений: Параметр reasoning enabled
- Огромная нагрузка: 1,15T токенов в неделю
Идеально подходит для:
- Длинных контекстных сценариев
- Агентных систем с использованием инструментов
- Математических и алгоритмических задач
- Интерактивных сред
- Задач, требующих эффективных рассуждений
Тарификация:
- Вход: 61 Искра за 1M токенов
- Выход: 91 Искра за 1M токенов
Дата релиза: 1 декабря 2025 г.