Навык превращает статичное изображение в видео и выбирает модель RunComfy под задачу: анимация портрета или продукта, lip-sync с пользовательской аудиодорожкой либо композиция с видео- и аудиореференсами. Запускает генерацию через локальный RunComfy CLI и сохраняет результат в указанную папку.
Возможности
- Направляет обычную анимацию изображения в HappyHorse 1.0 I2V; подходит для портретов, продуктов и плавных движений камеры.
- Для lip-sync с пользовательской озвучкой использует Wan 2.7 и
audio_urlс файлом WAV или MP3 длительностью 3–30 секунд и размером до 15 MB. - Для мультимодальной генерации выбирает Seedance 2.0 Pro: до 9 изображений, 3 видео и 3 аудиореференсов.
- Передаёт запрос через
runcomfy runи скачивает результат в--output-dir. - Учитывает подсказки для промптов: описывать движение, отделять стабильные детали от изменяемых и указывать номера референсов.
Когда использовать
- Нужно анимировать портрет, сохранив черты лица, или показать продукт в движении.
- Требуется синхронизировать talking-head видео с собственной озвучкой.
- Нужно объединить изображение персонажа, сцену из референсного видео и тон голоса из аудио.
- Нужна генерация image-to-video через RunComfy CLI с выбором модели по задаче.
Установка
npx skills add agentspace-so/runcomfy-skills --skill image-to-video -g
Примеры
Анимация портрета в HappyHorse 1.0 I2V:
runcomfy run happyhorse/happyhorse-1-0/image-to-video \
--input '{
"image_url": "https://.../portrait.jpg",
"prompt": "Gentle camera drift around the subject'\''s face, subtle breathing motion, identity-stable features, soft natural light."
}' \
--output-dir <absolute/path>
Lip-sync с пользовательской озвучкой в Wan 2.7:
runcomfy run wan-ai/wan-2-7/text-to-video \
--input '{
"prompt": "Medium close-up of a confident spokesperson in a softly-lit recording booth, leaning slightly toward the camera, locked tripod, shallow DOF, warm key light from camera-left.",
"audio_url": "https://.../voiceover-en.mp3",
"duration": 12,
"aspect_ratio": "9:16"
}' \
--output-dir <absolute/path>
Анимация с изображением, видео- и аудиореференсами в Seedance 2.0 Pro:
runcomfy run bytedance/seedance-v2/pro \
--input '{
"prompt": "Subject from image 1 walks through the café in video 1, voice tone matches audio 1. Medium close-up, slow push-in, warm light, gentle ambience.",
"image_url": ["https://.../subject.jpg"],
"video_url": ["https://.../cafe-locked-shot.mp4"],
"audio_url": ["https://.../voice-tone.mp3"],
"duration": 8
}' \
--output-dir <absolute/path>