API VEGA

Навык превращает статичное изображение в видео и выбирает модель RunComfy под задачу: анимация портрета или продукта, lip-sync с пользовательской аудиодорожкой либо композиция с видео- и аудиореференсами. Запускает генерацию через локальный RunComfy CLI и сохраняет результат в указанную папку.

Возможности

  • Направляет обычную анимацию изображения в HappyHorse 1.0 I2V; подходит для портретов, продуктов и плавных движений камеры.
  • Для lip-sync с пользовательской озвучкой использует Wan 2.7 и audio_url с файлом WAV или MP3 длительностью 3–30 секунд и размером до 15 MB.
  • Для мультимодальной генерации выбирает Seedance 2.0 Pro: до 9 изображений, 3 видео и 3 аудиореференсов.
  • Передаёт запрос через runcomfy run и скачивает результат в --output-dir.
  • Учитывает подсказки для промптов: описывать движение, отделять стабильные детали от изменяемых и указывать номера референсов.

Когда использовать

  • Нужно анимировать портрет, сохранив черты лица, или показать продукт в движении.
  • Требуется синхронизировать talking-head видео с собственной озвучкой.
  • Нужно объединить изображение персонажа, сцену из референсного видео и тон голоса из аудио.
  • Нужна генерация image-to-video через RunComfy CLI с выбором модели по задаче.

Установка

npx skills add agentspace-so/runcomfy-skills --skill image-to-video -g

Примеры

Анимация портрета в HappyHorse 1.0 I2V:

runcomfy run happyhorse/happyhorse-1-0/image-to-video \
  --input '{
    "image_url": "https://.../portrait.jpg",
    "prompt": "Gentle camera drift around the subject'\''s face, subtle breathing motion, identity-stable features, soft natural light."
  }' \
  --output-dir <absolute/path>

Lip-sync с пользовательской озвучкой в Wan 2.7:

runcomfy run wan-ai/wan-2-7/text-to-video \
  --input '{
    "prompt": "Medium close-up of a confident spokesperson in a softly-lit recording booth, leaning slightly toward the camera, locked tripod, shallow DOF, warm key light from camera-left.",
    "audio_url": "https://.../voiceover-en.mp3",
    "duration": 12,
    "aspect_ratio": "9:16"
  }' \
  --output-dir <absolute/path>

Анимация с изображением, видео- и аудиореференсами в Seedance 2.0 Pro:

runcomfy run bytedance/seedance-v2/pro \
  --input '{
    "prompt": "Subject from image 1 walks through the café in video 1, voice tone matches audio 1. Medium close-up, slow push-in, warm light, gentle ambience.",
    "image_url": ["https://.../subject.jpg"],
    "video_url": ["https://.../cafe-locked-shot.mp4"],
    "audio_url": ["https://.../voice-tone.mp3"],
    "duration": 8
  }' \
  --output-dir <absolute/path>