Loading...
Loading...
共找到 96 个 Skills
基于fal.ai托管模型的AI驱动图像编辑,支持风格迁移、背景移除、物体移除以及图像修复功能。
通过命令行在RunComfy上运行任意模型。`runcomfy` CLI是一个独立二进制文件,一次认证即可访问数百个模型端点——涵盖图像生成、图像编辑、视频生成、图生视频、唇形同步、人脸替换、视频编辑、图像修复、图像扩展、画面延伸、ControlNet、重新打光、图像超分辨率、LoRA训练等功能。提交请求、轮询状态、下载输出结果。本技能将指导Agent如何安装、认证、发现模型架构、调用模型、流式处理/轮询/无需等待、以JSON输出模式编写脚本以及处理错误。当触发词为“runcomfy cli”、“install runcomfy”、“runcomfy login”、“runcomfy run”、“runcomfy whoami”、“runcomfy api”,或任何明确要求从脚本或终端调用RunComfy模型的请求时,本技能将启动。相关的兄弟技能(ai-image-generation、ai-video-generation、image-edit、video-edit、face-swap、lipsync、image-to-video、image-inpainting、image-outpainting、video-extend、controlnet-pose、relight)均通过此CLI进行调度。
通过inference.sh CLI使用FLUX、Gemini、Grok、Seedream、Reve等50+模型生成AI图像。支持的模型包括:FLUX Dev LoRA、FLUX.2 Klein LoRA、Gemini 3 Pro Image、Grok Imagine、Seedream 4.5、Reve、ImagineArt。功能涵盖:文本转图像、图像转图像、图像修复、LoRA、图像编辑、图像超分辨率、文本渲染。适用场景:AI艺术创作、产品样机、概念艺术、社交媒体图形、营销视觉素材、插画。相关关键词:flux、图像生成、ai image、text to image、stable diffusion、generate image、ai art、midjourney替代方案、dall-e替代方案、text2img、t2i、图像生成器、ai picture、用AI创建图像、生成式AI、ai插画、grok image、gemini image
使用FFmpeg(音视频编码、格式转换、流媒体、滤镜处理、硬件加速)和ImageMagick(图像编辑、格式转换、批量处理、特效制作、图像合成)处理多媒体文件。适用于以下场景:转换媒体格式、使用特定编码(H.264、H.265、VP9)编码视频、调整图像大小/裁剪图像、从视频中提取音频、应用滤镜与特效、优化文件大小、创建流媒体清单(HLS/DASH)、生成缩略图、批量处理图像、创建合成图像或搭建媒体处理流水线。支持100余种格式、硬件加速(NVENC、QSV)以及复杂滤镜图。
使用SVG滤镜(feTurbulence、feDisplacementMap)、CSS动画和分层技术为网页创建逼真的云效果。适用于氛围感背景、天气效果、天空盒、视差场景以及装饰性云元素。可在以下场景启用:"云效果"、"SVG云"、"逼真云"、"氛围感背景"、"天空动画"、"feTurbulence"、"天气效果"、"视差云"。不适用于3D渲染(请使用WebGL/Three.js技能)、照片处理(请使用图像编辑工具)、天气数据API(请使用数据集成技能)或无体积效果的简单CSS渐变。
Google Gemini API图像生成实现指南 - 使用gemini-2.5-flash-image模型通过文本提示生成高质量图像。适用于图像生成、视觉内容创作或实现文本转图像功能的场景。支持文本转图像、图像编辑、多图像合成以及迭代优化。
借助fal.ai无服务器AI生成图片、视频与音频。适用于构建AI图像生成、视频生成、图像编辑或实时AI功能场景。涉及fal.ai、fal、AI图像生成、Flux、SDXL、实时AI、无服务器AI相关内容。
由Google Gemini Nano Banana模型提供支持的AI图像生成创意总监。该技能可用于所有涉及图像创作、编辑、视觉素材制作或创意指导的需求。触发场景包括:生成图像、创建照片、编辑图片、设计logo、制作横幅、为任意内容制作视觉素材,以及所有/banana命令。支持文生图、图像编辑、多轮创意会话、批量工作流和品牌预设。
为Bria的FIBO图像生成模型编写结构化的VGL(Visual Generation Language,视觉生成语言)JSON提示词。当你需要为文本生成图像、图像编辑、图像修复、图像扩展、背景生成或图像标注创建JSON格式的详细图像描述时,可使用此技能。触发场景包括编写结构化提示词、创建VGL JSON、为AI生成描述图像,或使用Bria/FIBO的structured_prompt格式的需求。此外,在将自然语言的图像请求转换为FIBO模型所需的确定性JSON schema时,也可使用此技能。
精通所有计算式拼贴构图:照片马赛克、网格布局、剪贴簿/日志风格、杂志排版、愿景板、情绪板、社交媒体拼贴、记忆墙、抽象/生成式排列,以及艺术史相关技法(霍克尼拼接法、达达主义摄影蒙太奇、超现实主义拼贴、劳森伯格组合艺术)。掌握基于边缘的拼接、Poisson blending、最优传输色彩协调和美学优化。触发关键词:'collage'、'photo mosaic'、'grid layout'、'scrapbook'、'vision board'、'mood board'、'photo wall'、'magazine layout'、'Hockney'、'joiner'、'photomontage'。请勿用于简单图像编辑(请使用native-app-designer)、生成新图像(请使用Stability AI)、单张照片增强(请使用photo-composition-critic)或基础图像相似度搜索(请使用clip-aware-embeddings)。
当用户希望在OSMO上编排缺陷图像生成、运行相关设置或处理输出时可使用本技能。Day 0路径通过USD-to-ROI、图像编辑增强和AnomalyGen处理冷启动,以创建初始PCBA数据集。Day 1路径对真实图像执行推理和标注。本技能可协助完成首次资产设置、微调检查点创建以及部署配置。 触发关键词:缺陷图像生成、dig工作流、dig流水线、缺陷图像检测工作流、aoi流水线、aoi anomalygen、usd2roi anomalygen、day 0 pcba、day 1 pcba、day 1真实照片对齐、day 1手动roi、金属表面异常、玻璃缺陷、anomalygen微调、setup_pcb、setup_metal、setup_glass、setup_pretrained、dig设置、dig数据集、dig预训练检查点、dig图像编辑端点。
在执行前控制图像生成请求。当用户需要文本转图像、图像编辑、参考图像生成、产品图、人物形象图、横幅、缩略图、分镜图或批量图像变体时使用此技能,该技能需识别输入、分类任务、选择模型/参考规则,然后转交给image-batch-runner。