Ling-3.0-flash — Mixture-of-Experts модель inclusionAI (124B параметров, ≈5.1B активных на токен). Спроектирована вокруг token efficiency и production-scale agentic inference: больше полезной работы в рамках лимитов токенов, задержки и стоимости сервинга.
В Darka One доступна как текстовая модель (текст → текст) с контекстом 131K и оплатой в Искрах. Подходит для повседневных и агентных задач, где важны скорость ответа и экономия токенов. Finance-специализация той же линейки — Ling 3.0 Flash Fin (каталог).
Ключевые характеристики:
- MoE 124B / ~5.1B active: разреженный вывод без полного актива всего параметра
- Token-efficient flash: меньше расхода на типичный turn
- Agentic inference: ориентация на production-агентов и tool-heavy циклы
- Контекст 131K: длинные сессии и документы среднего размера
- Текст → текст: классический чат без мультимодального входа
Идеально подходит для:
- Повседневных чатов и черновиков с упором на скорость
- Агентных циклов при ограниченном бюджете токенов
- Production-сервисов, где важны latency и cost-per-request
- Экспериментов с open-weight стеком inclusionAI Ling 3.0
Тарификация:
- Вход: 18 Искр за 1M токенов
- Выход: 53 Искры за 1M токенов
Дата релиза: 23 июля 2026 г.