Loading...
Loading...
共找到 29 个 Skills
在RunComfy上将任意静态图片动起来——该技能是一个智能路由工具,可将用户意图与RunComfy模型库中合适的i2v模型进行匹配。针对通用动画场景选择HappyHorse 1.0 I2V(竞技场排名第1,支持原生音频、身份保留);针对自定义旁白唇形同步场景选择带`audio_url`参数的Wan 2.7;针对图像+参考视频+参考音频的多模态动画场景选择Seedance 2.0 Pro。该技能整合了每个模型的文档提示模板,让调用者无需在错误模型上反复尝试即可获得更优质的输出。通过本地RunComfy CLI调用`runcomfy run <vendor>/<model>/image-to-video`(或其端点变体)。当触发词为"image to video"、"image-to-video"、"i2v"、"animate image"、"make this move"或任何明确要求将静态图转为视频的指令时,该技能启动。
在RunComfy上编辑现有视频——该Skill是一个智能路由工具,可将用户意图匹配到RunComfy模型库中合适的视频编辑模型。它会选择Wan 2.7 Edit-Video(通用风格重塑/背景替换/包装替换,保留人物身份与动作)、Kling 2.6 Pro Motion Control(将参考视频的精准动作迁移到目标角色)或Lucy Edit Restyle(轻量级身份稳定风格重塑/服装替换)。该Skill整合了每个模型的官方提示模板,无需在错误模型上反复尝试即可获得更精准的编辑效果。通过本地RunComfy CLI调用`runcomfy run <vendor>/<model>/<endpoint>`命令。当用户说出“video edit”“edit video”“restyle video”“swap video background”“motion control”“outfit swap video”或任何明确要求转换视频的指令时触发。
在RunComfy上使用OpenAI GPT Image 2(ChatGPT Images 2.0)生成和编辑图片。本文档介绍了GPT Image 2的优势(嵌入文本、标识、多语言排版、指令精准度)、三种固定尺寸、支持内容保留的编辑指令,以及何时转而使用同类模型(Flux 2 / Nano Banana Pro / Seedream)。通过本地RunComfy CLI调用`runcomfy run openai/gpt-image-2/text-to-image`或`/edit`命令。触发关键词包括“gpt image 2”、“gpt-image-2”、“ChatGPT Images 2”、“image 2”,或任何明确要求使用该模型生成或编辑图片的请求。
通过`runcomfy` CLI在RunComfy上创建AI头像、虚拟主播(Talking-Head)及唇同步视频。支持调用字节跳动OmniHuman(音频驱动全身头像)、万智源Wan 2-7(通过`audio_url`实现人像音频驱动嘴部同步)、HappyHorse 1.0(竞技场排名第一的文本转视频/图像转视频,支持内置音频)以及Seedance v2 Pro(多模态影视级生成,支持参考音频+参考主体)等模型。会根据用户的实际需求——UGC旁白、虚拟主持人、配音产品演示、唇同步角色、对话场景——选择合适的模型,并提供各模型的文档化提示模板以及最简`runcomfy run`调用指令。当用户提及“talking head”“lip sync”“avatar video”“让X说话”“audio to video”“audio driven avatar”“virtual presenter”“AI spokesperson”“dubbed video”“UGC avatar”“HeyGen替代方案”“Synthesia替代方案”“digital human”“让这张人像说话”“从旁白生成视频”或任何明确要求让面部开口说话的请求时,该功能将触发。
通过`runcomfy` CLI在RunComfy平台上将人脸/角色替换到视频或图片中。该功能可调用多种社区模型接口:Wan 2-2 Animate(音频驱动的角色动画+身份替换)、GPT Image 2 Edit(通过参考构图对静态图片进行单次精准人脸替换)、Nano Banana Edit(批量保留身份的替换)、Flux Kontext(单参考高保真局部人脸编辑)以及Kling 2-6 Motion Control Pro(将动作从一个表演转移到目标角色上)。系统会根据用户的实际需求选择合适的模型——比如是单张静态图还是视频、全角色替换还是仅人脸替换、对话场景还是无声动作场景。当用户提出诸如"face swap"、"swap face"、"deepfake"、"face replacement"、"character swap"、"head swap"、"把X的脸放到Y身上"、"让这个视频的主角变成X"、"替换视频中的演员"、"替换照片里的角色"、"deepfake视频"、"ReActor替代方案"等明确要求替换身份的指令时,该功能会触发。
通过`runcomfy` CLI在RunComfy上实现跨视频帧的区域编辑——移除出现在多帧中的物体、清理线缆或水印、用匹配的动态效果替换指定区域。该功能可对接Wan 2-7 edit-video(默认选项,基于空间语言的提示词驱动型区域编辑)、Lucy Edit Restyle(保持主体特征的区域重编辑)以及Seedream 4-0 edit-sequential(将视频视为帧堆栈处理时使用)。根据编辑需求是文本提示驱动、需保持主体特征,还是需要逐帧静态修复并串联成视频,自动选择合适的处理路径。当收到“video inpaint”“video inpainting”“remove from video”“mask region in video”“clean up video”“remove object from clip”“video patch”“frame-by-frame edit”“remove watermark from video”“remove passing person”等关键词,或任何明确要求跨视频帧编辑区域的请求时触发。
通过`runcomfy` CLI在RunComfy上实现掩码驱动的图像修复。当存在掩码时,将请求路由至通义千问MAI Z-Image Turbo Inpainting(支持掩码、强度和控制尺度的专用修复端点);当没有可用掩码且需通过描述指定区域时,则路由至保留身份的编辑模型(Nano Banana 2 Edit、GPT Image 2 Edit、FLUX Kontext Pro)。适用于对象移除、水印去除、区域替换、瑕疵修复,以及任何由二进制掩码定义目标区域的受控局部编辑场景。触发关键词包括“inpaint”“inpainting”“image inpaint”“remove from image”“fill region”“mask-driven edit”“remove watermark”“remove object”“patch the photo”“fill the hole”,或任何明确要求编辑静态图像特定掩码区域的请求。
通过`runcomfy` CLI在RunComfy上实现姿态条件生成。可对接Kling 2-6 Motion Control Pro/Standard(将参考视频的动作/分镜转移到目标角色)、社区版Wan 2-2 Animate(带姿态条件的音频驱动角色动画)以及Z-Image Turbo ControlNet LoRA(基于OpenPose/DWPose/边缘检测/深度控制图的姿态条件图像生成)。会根据视频/静态图、风格化/写实风格选择合适的对接路径。当出现"controlnet"、"control net"、"pose control"、"openpose"、"DWPose"、"transfer pose"、"motion control"、"pose driven"、"character pose"、"depth control"、"canny edge"、"use this pose"等关键词,或任何明确要求基于姿态/骨骼/动作/深度/边缘参考进行生成的请求时触发。
通过`runcomfy` CLI在RunComfy平台上为面部与指定音频轨道实现唇形同步。支持对接字节跳动OmniHuman(由肖像+音频驱动的全身体数字人)、Sync Labs sync v2/Pro(业界领先的视频唇形同步技术)、Kling lipsync(支持音频转视频和文本转视频的语音同步)以及Creatify lipsync。该技能会根据用户的实际需求选择合适的服务端点——包括肖像图片+音频(数字人风格)、源视频+音频(在现有视频上替换唇形)或基于脚本生成并同步。当用户说出“lip sync”“lipsync”“让这个视频说话”“匹配音频与唇形”“视频配音”“唇形与语音同步”“Sync Labs”“旁白同步”,或任何明确要求通过音频驱动面部唇形的指令时,该技能将触发。
通过`runcomfy` CLI在RunComfy上扩展或续接现有视频片段。该功能会调用Google Veo 3-1的`extend-video`和`fast/extend-video`端点——选择源视频并输入描述后续内容的提示词,模型就能生成与原视频在动作、光线和主体身份上保持一致的续接片段。适用于用户拥有较短Veo片段并想要延长时长,或者希望以单个种子片段为基础逐镜头构建连贯叙事的场景。当用户提出“extend video”“continue video”“longer video”“video extend”“make this clip longer”“Veo extend”“chain video shots”“video continuation”等明确要求,即对现有视频添加更多帧时,触发该功能。
通过`runcomfy` CLI在RunComfy上实现图像Outpainting——将静态图像扩展至原始画布之外,补全相机未捕捉到的内容,在保留原始内容的同时更改宽高比(正方形→16:9、竖屏→横屏)。支持调用Nano Banana 2 Edit(默认选项,基于空间语言驱动)、GPT Image 2 Edit(多参考图,匹配参考风格)、FLUX Kontext Pro(单次处理,最大程度保留原图)以及品牌专属编辑端点(Seedream / Dreamina / Qwen / FLUX 2)。会根据扩图需求是文本描述驱动、参考图驱动还是品牌风格锁定,选择合适的调用路径。当出现以下关键词时触发该功能:"outpaint"、"outpainting"、"extend image canvas"、"expand the image"、"fill in around the photo"、"uncrop"、"change aspect ratio"、"extend frame"、"wide-screen from square",或任何明确要求为现有静态图像添加画布的指令。
通过`runcomfy` CLI在RunComfy上为静态图像重新打光——更改灯光设置、色温、方向或氛围。当需要专业的重新打光时,会路由到Qwen Edit 2509专用的`relight` LoRA端点;若仅需通过文字描述灯光效果即可满足需求,则会 fallback 到保留主体特征的编辑端点(Nano Banana 2 Edit、GPT Image 2 Edit、FLUX Kontext Pro)。可用于产品重新打光(影室柔光箱→窗边自然光)、人像氛围转换(阴天→黄金时刻)或色彩分级调整。当出现“relight”“relighting”“change the lighting”“make it golden hour”“studio lighting”“rim light”“blue hour”“soft window light”“change light direction”“color temperature”等关键词,或任何明确要求更改静态图像灯光的指令时,将触发该功能。