HeyGen: Avatar IV

ВидеоПлатнаяДоступна

Релиз: 24 августа 2026 г.

Talking-head I2V от HeyGen: одно фото → expressive lip-synced видео до 1080p. Речь из TTS-скрипта или вашего audio track.

HeyGen: Avatar IV — модель image-to-video talking-head от HeyGen (OpenRouter: heygen/avatar-iv). Анимирует одно фото в expressive lip-synced ролик: учитывает не только форму губ, но и тон, ритм и эмоцию голоса — отсюда head motion, мимика и жесты. Выход до 1080p.

В Darka One — категория «Видео» (все active в video-picker). Входы: текст, изображение, аудио → видео. Речь берётся либо из текстового скрипта (HeyGen TTS), либо из приложенного audio track (прямой lip-sync). По OpenRouter GET /videos/models: разрешения 720p / 1080p, соотношения 16:9, 9:16, 1:1; дискретного списка duration нет — длина следует за скриптом/аудио. generate_audio: false (звук приходит из TTS или входного трека, а не отдельным toggle). Passthrough OR: voice, expressiveness, motion prompt, фон, captions, title — в UI ⚙ Darka One пока wired только разрешение и aspect ratio.

Ключевые характеристики:

  • Talking-head I2V: фото → говорящий портрет
  • TTS или audio: скрипт с озвучкой HeyGen либо свой трек
  • Expressiveness: тон и ритм голоса двигают голову, лицо и жесты
  • 720p · 1080p: выход до Full HD
  • Aspect: 16:9, 9:16, 1:1
  • Длительность: от длины речи / audio (OR не фиксирует enum секунд)

Идеально подходит для:

  • Аватаров и digital twin для презентаций
  • Маркетинговых talking-head роликов из одного кадра
  • Локализации: тот же кадр + другой скрипт/голос
  • Вертикальных (9:16) и квадратных (1:1) соцклипов
  • Lip-sync к готовой озвучке

Тарификация (list OR × markup 240 → Искры):

  • 12 Искр/сек ($0.05/сек) — одинаково для 720p и 1080p

💡 Пример: 5 с = 5 × 12 = 60 Искр
10 с = 10 × 12 = 120 Искр
30 с = 30 × 12 = 360 Искр
Резерв в чате без явной длительности опирается на типовой клип (~8 с), финальный settle — по usage.cost OR.

Дата релиза: 24 августа 2026 г.

🗣️ HeyGen Avatar IV — talking-head до 1080p