gpt-oss-120b — open-weight языковая модель OpenAI архитектуры Mixture-of-Experts (MoE) с 117B параметров, разработанная для высоких рассуждений, агентных и производственных сценариев общего назначения. Модель активирует 5,1B параметров за один проход и оптимизирована для работы на одном H100 GPU с нативной MXFP4 квантизацией.
Поддерживает настраиваемую глубину рассуждений, полный доступ к цепочке мыслей (chain-of-thought) и нативное использование инструментов, включая вызов функций, браузинг и генерацию структурированных выходных данных. Идеальный выбор для разработчиков, которым нужна мощная модель с открытым весом для самостоятельного развёртывания.
Ключевые характеристики:
- Open-weight: Свободно доступные веса для самостоятельного развёртывания
- MoE архитектура: 117B параметров, 5,1B активных на проход
- Оптимизация: Запуск на одном H100 с MXFP4 квантизацией
- Настраиваемые рассуждения: Конфигурируемая глубина мышления
- Полный CoT: Доступ ко всей цепочке рассуждений
- Native tool use: Вызов функций, браузинг, структурированный вывод
- Огромная нагрузка: 455B токенов в неделю
Идеально подходит для:
- Самостоятельного развёртывания (self-hosting)
- Агентных рабочих процессов
- Исследовательских задач
- Production-систем с высокими требованиями
- Сценариев с полным контролем над моделью
Тарификация:
- Вход: 10 Искр за 1M токенов
- Выход: 46 Искр за 1M токенов
Дата релиза: 5 августа 2025 г.