Локальная генерация видео из одного кадра на домашней GPU

Локальная генерация видео из фото: MiniMax H3, ComfyUI и RTX 4090

Сегодня я попросил агента оживить две обычные фотографии. На первой двое мужчин должны были взлететь из двора в позе супергероев. На второй пара должна была превратиться в Бэтмена и Женщину-кошку. Через несколько минут агент вернул готовые MP4 со звуком. Весь inference прошёл локально на моей RTX 4090. Агент самостоятельно выбрал video workflow, загрузил исходный кадр, составил подробный prompt, отправил задачу в очередь, дождался завершения и проверил финальный файл через ffprobe. ...

18 августа 2026 г. · 7 минут · 1292 слова · Сергей Клюкин
Эволюция comfy-skill и visual workflow для OpenClaw-агентов

Эволюция comfy-skill: от генерации картинок к полноценному visual workflow

Последние изменения в comfy-skill заметно расширили его возможности и, что важнее, изменили сам характер инструмента. Если раньше это был в основном skill для text-to-image генерации, то теперь он постепенно становится полноценным workflow layer для визуальных задач: генерации, редактирования, апскейла и анимации. Здесь важно сразу обозначить контекст: сам по себе comfy-skill не особенно интересен в отрыве от OpenClaw-агентов. Именно агенты выступают интерфейсом к этому слою возможностей: они выбирают сценарий, подставляют нужный workflow, управляют job-пайплайном, забирают результат и встраивают его в реальную задачу. Без этого связующего слоя вся история теряет большую часть практического смысла и превращается просто в набор разрозненных скриптов. Все изображения в этой статье, включая иллюстрации, галереи и анимированные фрагменты, тоже были сгенерированы OpenClaw-агентом в рамках этого же workflow. ...

9 апреля 2026 г. · 5 минут · 998 слов · Сергей Клюкин