Loading...
Loading...
共找到 29 个 Skills
在RunComfy上使用Google Nano Banana 2(Gemini家族闪存级文本生成图像模型)生成图像——该技能集成了模型官方文档中的提示模式,相比直接使用该模型的普通提示,能输出更优质的结果。文档介绍了Nano Banana 2的优势(快速迭代、图像内文字渲染、可预测构图、可选联网上下文)、分辨率层级定价、安全容忍度调节,以及何时转而使用Nano Banana Pro / GPT Image 2 / Flux 2 / Seedream。通过本地RunComfy CLI调用`runcomfy run google/nano-banana-2/text-to-image`。当触发关键词为"nano banana"、"nano-banana-2"、"nano banana 2"、"google image gen"、"gemini image",或明确要求使用该模型生成图像时启动。
在RunComfy上使用Google Nano Banana 2(图像到图像编辑端点)编辑图片。本文档介绍了Nano Banana Edit的优势(保留主体身份、替换背景、使用空间语言定位编辑、支持最多20个输入的多图批量编辑)、输入schema,以及何时转而使用GPT Image 2 edit / Flux Kontext / Nano Banana 2 t2i。通过本地RunComfy CLI调用`runcomfy run google/nano-banana-2/edit`。当出现“nano banana edit”、“edit with nano banana”、“image edit nano banana”或任何明确要求使用该模型进行编辑的指令时触发。
在RunComfy上编辑图片——该技能是一个智能路由工具,可将用户的意图匹配到RunComfy模型库中合适的编辑模型。它会选择Nano Banana Edit(最多支持20张批量处理,默认保留主体特征)、OpenAI GPT Image 2 Edit(支持多语言图像内文字改写、多参考图合成、布局精准调整)、Flux Kontext Pro(单参考图高保真局部编辑)或Z-Image Turbo Inpaint(基于蒙版的精准区域编辑)。该技能整合了每个模型的文档提示模板,无需反复尝试错误模型即可获得更精准的编辑效果。通过本地RunComfy CLI调用`runcomfy run <vendor>/<model>/edit`命令。当用户输入“image edit”“edit image”“image-to-image”“i2i”“swap background”“remove object”“rewrite headline”或任何明确要求编辑单张或批量图片的指令时触发该技能。
在RunComfy上使用Flux 1 Kontext Pro(Black Forest Labs推出的精准局部图像编辑模型)编辑图片——该技能内置了模型文档中记录的提示词模式,相比直接使用基础提示词调用同一模型,能获得更优质的输出。本文档介绍了Flux Kontext的优势(单参考精准局部编辑、强大的提示词控制、持续高保真输出)、输入格式(单张图片+提示词),以及何时转而使用Nano Banana Edit / GPT Image 2 edit / Flux 2 Klein。通过本地RunComfy CLI调用`runcomfy run blackforestlabs/flux-1-kontext/pro/edit`命令。当触发词为“flux kontext”、“flux-kontext”、“flux 1 kontext”、“kontext”、“BFL kontext”,或用户明确要求使用该模型进行编辑时,启动此技能。
在RunComfy上使用Wan 2.7(Wan-AI的旗舰运动模型)生成文本转视频。本文档介绍了Wan 2.7的优势(多参考条件控制、通过`audio_url`实现音频驱动的唇形同步、更流畅的转场、提示词扩展)、时长/分辨率/宽高比规范,以及何时转而使用HappyHorse 1.0 / Seedance 2.0 / Kling / LTX 2。通过本地RunComfy CLI调用`runcomfy run wan-ai/wan-2-7/text-to-video`。当触发词为"wan"、"wan 2.7"、"wan-2-7"、"wan video"或任何明确要求使用该模型生成视频的请求时执行。
在RunComfy上使用OpenAI GPT Image 2(ChatGPT Images 2.0的`/edit`端点)编辑图片——该工具集成了模型官方文档中的提示模式,相比直接使用原生提示词调用同一模型,能生成更优质的输出。本文档介绍了GPT Image Edit的优势(保留特征语言、多语言图像内文本编辑、最多支持10张参考图、布局/排版精度)、数据结构,以及何时转而使用Nano Banana Edit / Flux Kontext / GPT Image 2文本转图像模型。通过本地RunComfy CLI调用`runcomfy run openai/gpt-image-2/edit`。当触发词为"gpt image edit"、"gpt-image-edit"、"chatgpt image edit"、"edit with gpt image 2"或任何明确要求使用该模型进行编辑的指令时启动。
使用RunComfy平台上的字节跳动Seedance 2.0 Pro生成电影风格短视频。本文档介绍了Seedance 2.0 Pro的优势(多模态参考——最多支持9张图片、3个视频、3段音频;同步内通音频与自然唇形同步;电影级运动优化)、4-15秒的时长规范,以及何时转而使用HappyHorse 1.0 / Wan 2.7 / Kling模型。通过本地RunComfy CLI调用`runcomfy run bytedance/seedance-v2/pro`。当出现“seedance”、“seedance 2”、“seedance v2”、“seedance pro”、“bytedance video”或任何明确要求使用该模型生成视频的指令时触发。
在RunComfy上使用HappyHorse 1.0生成文本转视频。本文档介绍了HappyHorse 1.0的优势(在Artificial Analysis Video Arena排名第一、原生1080p分辨率并支持生成过程同步音频、多镜头角色一致性、支持6种语言提示词)、时长/宽高比/分辨率配置规则,以及何时转而使用Wan 2.7/Seedance 2/LTX 2。通过本地RunComfy CLI调用`runcomfy run happyhorse/happyhorse-1-0/text-to-video`。当触发词为“happyhorse”、“happy horse”、“happyhorse 1.0”、“happyhorse video”或任何明确要求使用该模型生成视频的请求时执行。
在RunComfy上使用Flux 2 Klein(Black Forest Labs推出的Flux 2精简高速变体)生成图像——该技能集成了模型官方文档中的提示词模式,相比直接使用朴素提示词调用同一模型,能获得更优质的输出。本文档介绍了Flux 2 Klein的优势(亚秒级延迟、多参考品牌风格、主语优先的声明式提示词)、步数策略(4–8步用于快速迭代,约25步用于精细化处理)、9B与4B变体的权衡,以及何时转而使用Flux 2 Pro / Seedream 5 / GPT Image 2。通过本地RunComfy CLI调用`runcomfy run blackforestlabs/flux-2-klein/9b/text-to-image`(或`/4b/`)。当触发词为“flux 2 klein”、“flux-2-klein”、“flux klein”、“BFL flux 2”,或用户明确要求使用该模型生成图像时启动。
在RunComfy上使用Kling 3.0生成视频。Kling 3.0(也称为Kling V3.0)是快手科技推出的第三代多镜头视频模型,具备原生同步音频功能,且镜头间角色身份保持一致。该技能涵盖Kling 3.0的全部6个端点,包含三种渲染等级(Standard、Pro、4K)和两种模式(text-to-video文本转视频、image-to-video图像转视频)。可通过本地RunComfy CLI调用`runcomfy run kling/kling-3.0/<tier>/<mode>`命令。当触发词为“kling”、“kling 3.0”、“kling v3”、“kling pro”、“kling 4k”、“kling text to video”、“kling image to video”,或任何明确要求使用Kling 3.0生成或制作动画的请求时,将启动该技能。
RunComfy上的Codex Pet生成工具。只需一张参考图片,即可生成兼容Codex的Codex Pet精灵表spritesheet.webp和pet.json文件,将其放入`${CODEX_HOME:-$HOME/.codex}/pets/<name>/`目录后,Codex就会将其识别为自定义Codex Pet,与内置的8款宠物并列。该技能可生成Codex所需的标准Codex Pet图集(1536x1872像素的PNG/WebP格式,8列×9行,每个单元格192x208像素,包含9种动画状态——idle、running-right、running-left、waving、jumping、failed、waiting、running、review)。它通过本地RunComfy CLI调用一次OpenAI GPT Image 2编辑接口(命令为`runcomfy run openai/gpt-image-2/edit`)生成标准Codex Pet姿态,然后通过ImageMagick微变换以编程方式组装全部9行动画——无需Codex Pro、无需`$imagegen`、无需OPENAI_API_KEY,仅需RUNCOMFY_TOKEN即可使用。当触发词为“codex pet”、“create codex pet”、“make codex pet”、“hatch codex pet”、“/hatch image”、“desktop pet codex”、“codex pets”、“spritesheet.webp”,或任何明确要求为OpenAI Codex创建自定义宠物的指令时,该技能会启动。
通过`runcomfy` CLI在RunComfy上使用ElevenLabs Music生成完整歌曲和器乐轨道。ElevenLabs Music可将风格描述加上结构化歌词转换为专业级44.1 kHz立体声音频——时长从5秒到5分钟——支持段落级控制(前奏/主歌/副歌/桥段)、多语言人声,且输出可用于商业用途。你可以生成伴奏、完整带人声歌曲、广告歌、播客开场曲、游戏循环音乐或器乐背景音。该工具通过本地RunComfy CLI调用`runcomfy run elevenlabs/elevenlabs/music-generation`。当触发词为“generate music”“make a song”“AI music”“background music”“instrumental track”“ElevenLabs Music”“soundtrack”“jingle”“theme music”“royalty-free music”“compose”,或任何明确要求通过文本描述生成音乐或歌曲的指令时,该功能会启动。