Ling-3.0-flash

ТекстПлатнаяДоступна

Релиз: 23 июля 2026 г.

MoE 124B (≈5.1B активных) от inclusionAI: token-efficient flash для production agentic inference при ограниченном бюджете токенов и latency. Контекст 131K.

Вход: 18 искр/1M токенов модели · Выход: 53 искр/1M токенов модели

Ling-3.0-flash — Mixture-of-Experts модель inclusionAI (124B параметров, ≈5.1B активных на токен). Спроектирована вокруг token efficiency и production-scale agentic inference: больше полезной работы в рамках лимитов токенов, задержки и стоимости сервинга.

В Darka One доступна как текстовая модель (текст → текст) с контекстом 131K и оплатой в Искрах. Подходит для повседневных и агентных задач, где важны скорость ответа и экономия токенов. Finance-специализация той же линейки — Ling 3.0 Flash Fin (каталог).

Ключевые характеристики:

  • MoE 124B / ~5.1B active: разреженный вывод без полного актива всего параметра
  • Token-efficient flash: меньше расхода на типичный turn
  • Agentic inference: ориентация на production-агентов и tool-heavy циклы
  • Контекст 131K: длинные сессии и документы среднего размера
  • Текст → текст: классический чат без мультимодального входа

Идеально подходит для:

  • Повседневных чатов и черновиков с упором на скорость
  • Агентных циклов при ограниченном бюджете токенов
  • Production-сервисов, где важны latency и cost-per-request
  • Экспериментов с open-weight стеком inclusionAI Ling 3.0

Тарификация:

  • Вход: 18 Искр за 1M токенов
  • Выход: 53 Искры за 1M токенов

Дата релиза: 23 июля 2026 г.