Loading...
Loading...
共找到 20 个 Skills
通过inference.sh CLI使用FLUX、Gemini、Grok、Seedream、Reve等50+模型生成AI图像。支持的模型包括:FLUX Dev LoRA、FLUX.2 Klein LoRA、Gemini 3 Pro Image、Grok Imagine、Seedream 4.5、Reve、ImagineArt。功能涵盖:文本转图像、图像转图像、图像修复、LoRA、图像编辑、图像超分辨率、文本渲染。适用场景:AI艺术创作、产品样机、概念艺术、社交媒体图形、营销视觉素材、插画。相关关键词:flux、图像生成、ai image、text to image、stable diffusion、generate image、ai art、midjourney替代方案、dall-e替代方案、text2img、t2i、图像生成器、ai picture、用AI创建图像、生成式AI、ai插画、grok image、gemini image
通过`runcomfy` CLI在RunComfy上生成和编辑图像——这是一款覆盖全量图像模型目录的智能路由工具,支持的模型包括:FLUX 2(Klein 9B/4B、Pro、Dev、Flash、Turbo、Max)、Google Nano Banana 2/Pro、OpenAI GPT Image 2、字节跳动Seedream 5/4-5/4-0及Dreamina 4-0、阿里云Qwen Image和Z-Image Turbo、Wan 2-7。它同时支持文本转图像(t2i)和图像转图像/编辑(i2i)端点——该技能会根据用户的实际需求(排版精度、写实肖像、亚秒级迭代、多参考品牌风格、开源权重工作流)选择合适的模型,并提供每个模型的文档化提示模板以及最简`runcomfy run`调用指令。当用户提出“生成图像”“制作图片”“文本转图像”“AI图像”“制作一张……的图像”“图像转图像”“i2i”或任何明确要求创建或重新设计图像的请求时,该技能会触发。
全面兼容OpenAI的GPT Image 2工具,覆盖images/generations、images/edits以及使用image_generation工具的responses功能。当单次图像助手无法满足需求时使用——支持文本转图像、蒙版编辑、多图像批量生成、流式传输、partial_images以及文本+图像混合的Responses流程。读取.env文件并遵循进程环境变量;可与任何兼容OpenAI的网关配合使用。
3D风格图像生成:3D角色、产品渲染图、等距立体场景、3D图标、3D文字、室内设计渲染图、建筑可视化效果、3D场景、游戏资产。 当需要根据文本描述或参考照片生成3D风格的2D图像时使用(例如:3D角色设计、等距立体场景、3D产品渲染图、室内设计可视化效果、建筑渲染图、3D应用图标、3D文字效果、游戏资产渲染图)。
通过HuggingFace Diffusers使用Stable Diffusion模型实现最先进的文本到图像生成。适用于根据文本提示生成图像、执行图像到图像转换、图像修复或构建自定义扩散工作流的场景。
通过5个维度(类型、配色、渲染风格、文本呈现、氛围)生成文章封面图。支持宽银幕(2.35:1)、全景宽屏(16:9)和正方形(1:1)等比例。当用户要求“生成封面图”“创建文章封面”或“制作封面”时使用。
当用户想要创建图片、绘图、绘画或生成艺术作品时,使用AI生成图像。支持文本转图像和图像转图像生成功能。
[QianWen] 使用Wan和Qwen Image模型生成和编辑图像。支持文本转图像、图像编辑(风格迁移、主体一致性、文本渲染)以及文本-图像交错输出。触发场景:用户想要创建插画、产品图、艺术设计、海报,进行文本转图像生成,编辑/转换现有图像,应用风格迁移,基于参考照片生成图像,生成文本-图像交错内容,提及Wan/Qwen Image模型/AI艺术创作,或明确通过名称调用此技能(例如use qianwen-image-generation)。请勿触发场景:用户想要理解/分析现有图像或进行OCR(使用qianwen-vision),视频生成(使用qianwen-video-generation),纯文本任务。
Google Gemini API图像生成实现指南 - 使用gemini-2.5-flash-image模型通过文本提示生成高质量图像。适用于图像生成、视觉内容创作或实现文本转图像功能的场景。支持文本转图像、图像编辑、多图像合成以及迭代优化。
基于CLI的图像生成工具,通过Python调用Google Gemini APIs,根据文本提示生成图像。适用于用户需要「生成图像」「用AI创建图像」「Gemini图像」「文本转图像」「创建精灵图」或「生成角色艺术图」的场景。支持模型选择、批量生成、水印去除和背景透明化。请勿用于Web应用图像功能(请使用nano-banana-builder)、视频/音频生成或非Gemini模型的场景。
通过AceDataCloud API使用基于Gemini的NanoBanana生成和编辑AI图像。适用于根据文本提示创建图像或使用文本指令编辑现有图像的场景。支持nano-banana、nano-banana-2、nano-banana-pro及其:official变体。
搜索并集成来自fal.ai平台的Fal AI模型。当用户需要(1)在Fal AI平台上搜索模型,(2)获取特定Fal AI模型的详细信息,(3)将Fal AI模型集成到项目中,(4)探索fal.ai上可用的AI模型,或者提及“fal.ai”、“图像生成”、“AI video model”、“text to image”、“text-to-speech”时使用。