Loading...
Loading...
共找到 205 个 Skills
使用ffmpeg/ffprobe探测、修剪、转码、拼接和提取本地音视频文件。适用于媒体文件的转换或检查场景。**不支持**AI图像生成(draw-thing)或UI设计(design)功能。
在RunComfy上使用Google Nano Banana 2(Gemini家族闪存级文本生成图像模型)生成图像——该技能集成了模型官方文档中的提示模式,相比直接使用该模型的普通提示,能输出更优质的结果。文档介绍了Nano Banana 2的优势(快速迭代、图像内文字渲染、可预测构图、可选联网上下文)、分辨率层级定价、安全容忍度调节,以及何时转而使用Nano Banana Pro / GPT Image 2 / Flux 2 / Seedream。通过本地RunComfy CLI调用`runcomfy run google/nano-banana-2/text-to-image`。当触发关键词为"nano banana"、"nano-banana-2"、"nano banana 2"、"google image gen"、"gemini image",或明确要求使用该模型生成图像时启动。
在RunComfy上使用Flux 2 Klein(Black Forest Labs推出的Flux 2精简高速变体)生成图像——该技能集成了模型官方文档中的提示词模式,相比直接使用朴素提示词调用同一模型,能获得更优质的输出。本文档介绍了Flux 2 Klein的优势(亚秒级延迟、多参考品牌风格、主语优先的声明式提示词)、步数策略(4–8步用于快速迭代,约25步用于精细化处理)、9B与4B变体的权衡,以及何时转而使用Flux 2 Pro / Seedream 5 / GPT Image 2。通过本地RunComfy CLI调用`runcomfy run blackforestlabs/flux-2-klein/9b/text-to-image`(或`/4b/`)。当触发词为“flux 2 klein”、“flux-2-klein”、“flux klein”、“BFL flux 2”,或用户明确要求使用该模型生成图像时启动。
通过`runcomfy` CLI在RunComfy上实现姿态条件生成。可对接Kling 2-6 Motion Control Pro/Standard(将参考视频的动作/分镜转移到目标角色)、社区版Wan 2-2 Animate(带姿态条件的音频驱动角色动画)以及Z-Image Turbo ControlNet LoRA(基于OpenPose/DWPose/边缘检测/深度控制图的姿态条件图像生成)。会根据视频/静态图、风格化/写实风格选择合适的对接路径。当出现"controlnet"、"control net"、"pose control"、"openpose"、"DWPose"、"transfer pose"、"motion control"、"pose driven"、"character pose"、"depth control"、"canny edge"、"use this pose"等关键词,或任何明确要求基于姿态/骨骼/动作/深度/边缘参考进行生成的请求时触发。
通过inference.sh CLI使用FLUX、Gemini、Grok、Seedream、Reve等50+模型生成AI图像。支持的模型包括:FLUX Dev LoRA、FLUX.2 Klein LoRA、Gemini 3 Pro Image、Grok Imagine、Seedream 4.5、Reve、ImagineArt。功能涵盖:文本转图像、图像转图像、图像修复、LoRA、图像编辑、图像超分辨率、文本渲染。适用场景:AI艺术创作、产品样机、概念艺术、社交媒体图形、营销视觉素材、插画。相关关键词:flux、图像生成、ai image、text to image、stable diffusion、generate image、ai art、midjourney替代方案、dall-e替代方案、text2img、t2i、图像生成器、ai picture、用AI创建图像、生成式AI、ai插画、grok image、gemini image
通过Higgsfield的gpt_image_2模型,借助特定模式的提示词优化生成品牌级产品图片。这是制作任何涉及产品的专业品牌视觉内容的唯一入口。适用于以下场景:「制作产品照片」「棚拍」「生活场景照」「使用场景照」「Pinterest图钉」「主视觉横幅」「网站页眉」「轮播图」「Meta广告」「广告创意」「模特穿戴」「虚拟试穿」「人物手持产品」「手部特写」「悬浮产品」「漂浮效果」「水花镜头」「CGI风格」「超现实产品」「重新风格化」「圣诞版本」「[特定美学]风格」,或任何涉及产品、品牌或付费社交创意的需求。支持模式:product_shot、lifestyle_scene、closeup_product_with_person、pinterest_pin、hero_banner、social_carousel、ad_creative_pack、virtual_model_tryout、conceptual_product、restyle。最终提示词由后端组装——请勿手动编写gpt_image_2提示词,务必通过该技能操作。不适用于:无品牌/产品的纯文本转图片(请使用higgsfield-generate)、带虚拟形象的品牌营销视频(请使用higgsfield-generate的Marketing Studio)、Soul Character训练(请使用higgsfield-soul-id)。
通过`runcomfy` CLI在RunComfy上生成和编辑图像——这是一款覆盖全量图像模型目录的智能路由工具,支持的模型包括:FLUX 2(Klein 9B/4B、Pro、Dev、Flash、Turbo、Max)、Google Nano Banana 2/Pro、OpenAI GPT Image 2、字节跳动Seedream 5/4-5/4-0及Dreamina 4-0、阿里云Qwen Image和Z-Image Turbo、Wan 2-7。它同时支持文本转图像(t2i)和图像转图像/编辑(i2i)端点——该技能会根据用户的实际需求(排版精度、写实肖像、亚秒级迭代、多参考品牌风格、开源权重工作流)选择合适的模型,并提供每个模型的文档化提示模板以及最简`runcomfy run`调用指令。当用户提出“生成图像”“制作图片”“文本转图像”“AI图像”“制作一张……的图像”“图像转图像”“i2i”或任何明确要求创建或重新设计图像的请求时,该技能会触发。
通过inference.sh CLI使用Google Gemini原生图像模型生成图片。支持模型:Gemini 3 Pro Image、Gemini 2.5 Flash Image。功能:文本生成图像、图像编辑、多图像输入。触发词:nano banana、gemini image、gemini 3 pro image、gemini 2.5 flash image、google image generation、native image generation、gemini native image
当用户需要为营销场景创建、生成、编辑或优化图片时——包括博客首图、社交平台素材、产品样机图、个人资料横幅、列表展示图或品牌资产。当用户提及以下关键词时也适用:'AI image generation'、'generate an image'、'create a graphic'、'product mockup'、'hero image'、'social media graphic'、'banner image'、'cover photo'、'profile banner'、'listing screenshot'、'Flux'、'Midjourney'、'DALL-E'、'GPT Image'、'Ideogram'、'Gemini image'、'Canva'、'Figma'、'image optimization'、'compress images'、'WebP'或'OG image'。本技能适用于通用营销图片的创建与优化。如需付费广告图片创意及平台特定广告规格相关内容,请查看ad-creative技能。如需视频制作相关内容,请查看video技能。
在RunComfy上使用OpenAI GPT Image 2(ChatGPT Images 2.0)生成和编辑图片。本文档介绍了GPT Image 2的优势(嵌入文本、标识、多语言排版、指令精准度)、三种固定尺寸、支持内容保留的编辑指令,以及何时转而使用同类模型(Flux 2 / Nano Banana Pro / Seedream)。通过本地RunComfy CLI调用`runcomfy run openai/gpt-image-2/text-to-image`或`/edit`命令。触发关键词包括“gpt image 2”、“gpt-image-2”、“ChatGPT Images 2”、“image 2”,或任何明确要求使用该模型生成或编辑图片的请求。
基于Gemini原生的Nano Banana图像生成与编辑工具,支持Nano Banana、Nano Banana 2和Nano Banana Pro版本。适用于文本生成图像、图像编辑、多本地参考图生成、批量生成、预演请求检查,或使用自定义Gemini兼容基础URL(如自托管网关)的场景。
通过 inference.sh CLI 使用 Pruna P-Image 模型生成图像。支持的模型包括:P-Image、P-Image-LoRA、P-Image-Edit、P-Image-Edit-LoRA。功能特性:文生图、图像编辑、LoRA 风格生成、多图像合成、快速推理。Pruna 在不损失画质的前提下对模型进行了速度优化。触发关键词:pruna, p-image, pruna image, fast image generation, optimized flux, pruna ai, p image, fast ai image, economic image generation, cheap image generation