Grok STT 1.0

Речь в текстПлатнаяДоступна

Релиз: 23 июля 2026 г.

Speech-to-text xAI: транскрипция с word-level timestamps, опциональная speaker diarization и multichannel audio.

Grok STT 1.0 — модель speech-to-text от xAI (доступна у провайдера через REST /v1/stt). Поддерживает транскрипцию с word-level timestamps, опциональную speaker diarization и multichannel аудио.

В Darka One — категория «Речь в текст» и STT-picker чата. Базовый сценарий чата: аудио → текст транскрипта; расширенные опции diarization/multichannel зависят от того, что прокидывает runtime (как у других STT — не обещаем отдельный UI под каждую фичу провайдера).

Ключевые характеристики:

  • xAI Grok STT: распознавание речи семейства Grok
  • Word-level timestamps: таймкоды на уровне слов
  • Speaker diarization: опциональное разделение спикеров
  • Multichannel: поддержка многоканального аудио
  • Аудио → текст: классический STT в чате Darka One

Идеально подходит для:

  • Транскрибации встреч и подкастов
  • Сценариев, где нужны таймкоды по словам
  • Записей с несколькими спикерами (diarization у провайдера)
  • Многоканальных аудиопотоков
  • Пользователей экосистемы Grok / xAI

Тарификация:

  • 24 Искры за час аудио

💡 Пример: 1 час аудио = 24 Искры

Дата релиза: 23 июля 2026 г.

🎙️ Timestamps + diarization + multichannel от xAI