Loading...
Loading...
共找到 29 个 Skills
通过`runcomfy` CLI在RunComfy上实现视频扩图——扩展视频的空间画布,更改画幅比例(从9:16竖屏转为16:9横屏,或反之),在保留核心动作的同时为原始画面添加周边环境。对于由提示词驱动的空间扩展,将通过Wan 2-7 edit-video进行处理;若用于重要内容交付且对拼接质量有要求,则会引导Agent使用专用的ComfyUI扩图工作流。当出现“video outpaint”“video outpainting”“extend video canvas”“expand video frame”“uncrop video”“aspect ratio change”“vertical to horizontal video”“16:9 from 9:16”“TikTok to YouTube”等关键词,或任何明确要求扩展视频空间画布的请求时,将触发该功能。
通过`runcomfy` CLI在RunComfy平台使用ACE Step生成、修复(inpaint)和扩展(outpaint)音乐。ACE Step是StepFun-AI推出的开源权重音乐基础模型——支持标签驱动创作(涵盖流派、情绪、乐器)、带段落标记的多语种歌词,可生成5秒至4分钟的立体声输出,每秒成本为0.0002–0.0003美元(约比ElevenLabs Music便宜27倍)。提供四个端点:ACE Step文本转音频(默认选项)、ACE Step 1.5文本转音频(支持50+语种歌词,优化了结构化歌词处理)、ACE Step音频修复(重新生成现有音轨中的指定时间段内容)、ACE Step音频扩展(在现有音轨的前后添加内容)。当触发词为“ace step”、“ace-step”、“acestep”、“ACE music”、“open music model”、“cheap AI music”、“inpaint audio”、“audio inpaint”、“extend music”、“audio outpaint”、“lengthen track”、“music with tags”,或任何明确要求使用ACE Step生成或编辑音乐的指令时,该工具将启动。
通过`runcomfy` CLI在RunComfy上生成和编辑图像——这是一款覆盖全量图像模型目录的智能路由工具,支持的模型包括:FLUX 2(Klein 9B/4B、Pro、Dev、Flash、Turbo、Max)、Google Nano Banana 2/Pro、OpenAI GPT Image 2、字节跳动Seedream 5/4-5/4-0及Dreamina 4-0、阿里云Qwen Image和Z-Image Turbo、Wan 2-7。它同时支持文本转图像(t2i)和图像转图像/编辑(i2i)端点——该技能会根据用户的实际需求(排版精度、写实肖像、亚秒级迭代、多参考品牌风格、开源权重工作流)选择合适的模型,并提供每个模型的文档化提示模板以及最简`runcomfy run`调用指令。当用户提出“生成图像”“制作图片”“文本转图像”“AI图像”“制作一张……的图像”“图像转图像”“i2i”或任何明确要求创建或重新设计图像的请求时,该技能会触发。
通过`runcomfy` CLI在RunComfy上生成AI视频——这是一个覆盖全量视频模型库的智能路由工具,支持的模型包括:HappyHorse 1.0(竞技场排名第1,原生同步音频生成)、Wan-AI Wan 2-7(开源权重,音频驱动唇形同步)、ByteDance Seedance v2/1-5/1-0(多模态电影级)、Kling 3.0/2-6、Google Veo 3-1、MiniMax Hailuo 2-3、ByteDance Dreamina 3-0。支持文本转视频(t2v)、图像转视频(i2v)以及Veo的视频延长端点。该技能会根据用户需求(竞技场顶级质量、多镜头角色一致性、同步音频生成、电影级运镜、最快生成路径、15秒以内片段、最长时长)选择合适的模型,并提供每个模型的官方提示词模板以及最简`runcomfy run`调用指令。当用户输入“generate video”“make a video”“text to video”“t2v”“image to video”“i2v”“animate”“AI video”“make X move”“video from prompt”“video from image”或任何明确要求通过提示词或静态图生成视频片段的指令时,该技能会触发。
通过`runcomfy` CLI在RunComfy上生成AI音乐——这是一款跨音乐模型库的智能路由工具。可对接ElevenLabs AI音乐生成(提供高品质44.1 kHz立体声人声曲目,时长5秒至5分钟,单价0.0083美元/秒)以及ACE Step/ACE Step 1.5(StepFun-AI开源权重模型,标签驱动创作,支持多语言歌词,单价0.0002-0.0003美元/秒,约比ElevenLabs便宜27倍),还支持ACE Step音频修复(重新生成现有曲目内的指定时间段内容)和ACE Step音频扩展(在现有曲目前后延长时长)。它会根据用户的实际需求选择合适的模型,比如高品质人声钩子、低成本背景音乐库、多语言流行歌曲、修复糟糕的副歌、将30秒草稿延长至2分钟成品等,并提供每个模型的官方提示词模板以及最简`runcomfy run`调用指令。当用户提出“生成音乐”“制作歌曲”“AI音乐”“背景音乐”“器乐曲目”“原声配乐”“广告短曲”“主题音乐”“免版权音乐”“作曲”“带歌词的音乐”“扩展音乐”“修复这首歌”“修复音乐片段”等明确的生成或编辑音乐请求时触发。