Loading...
Loading...
共找到 74 个 Skills
AI图片生成技能,使用ChatGPT最新生图 gpt-image-2-all,当用户需要生成图片、视觉信息图、创建图像、编辑/修改/调整已有图片时使用此技能。基于API易平台(https://api.apiyi.com/)的ChatGPT最新生图gpt-image-2-all模型(gpt-image-2-all)的图片生成服务,无需访问外网。该模型以 $0.03/张 按次计费,支持文生图、单图编辑、多图融合、自然语言改图,文字还原度高、中文提示词友好。尺寸通过prompt描述控制(无显式size参数)与NanoBanana2不同的关键点:无size参数,需在prompt开头描述尺寸;统一$0.03/张无分辨率阶梯;使用对话式端点/v1/chat/completions为主推。
当有人要求增强图片、生成AI图片、移除背景、提升图片质量或创建产品图时使用本技能。当用户提及“AI图片生成”“生成图片”“增强我的照片”“移除背景”“提升图片质量”“优化这张图片”“产品图增强”“生成背景”“图片增强”“AI照片”或“修饰我的图片”时也可使用。本技能使用Sivi的generate API,通过AI模型创建或增强图片。如需上传本地现有文件,请查看brand-assets;如需通过提示词生成设计,请查看generate-design。
通过scripts/目录下的脚本,使用Google Gemini和Imagen模型生成图片。可用于AI图片生成、文本转图片、根据提示词创建视觉内容、生成多张图片、自定义宽高比以及生成最高4K的高分辨率输出。触发词包括“generate image”“create image”“imagen”“text to image”“AI art”“nano banana”。
使用Gemini(默认)或fal.ai FLUX.2 klein 4B(--cheap参数用于快速/低成本生成)生成图片。使用Grok Imagine(默认)或fal.ai LTX-2(--cheap参数)生成视频。适用场景:创建图片、生成视觉内容、AI图片生成、海报制作、视频生成。
当其他Skill需要将图片源解析为Sivi媒体ID(mId)或媒体URL时使用。支持4种输入源——本地文件上传、直接图片URL、产品/网页URL自动提取、AI生成,并返回统一结果(mId + mediaUrl)。这是一个被复合Skill(如generate-design、create-a-plus-content等)引用的工具类Skill,用于避免重复编写媒体处理脚本。如需支持文件夹存储的品牌级资产管理,请查看brand-assets。如需独立的AI图片生成/增强功能,请查看enhance-media。
具备全生命周期管理能力的博客引擎,包含12项命令、12种内容模板、5大类100分制评分体系以及4个专属Agent。针对Google排名(适配2025年12月核心算法更新、E-E-A-T标准)和AI引用(GEO/AEO)进行优化。支持博客内容的撰写、重写、分析、大纲生成、审核与再利用,采用以答案为优先的格式,搭配有来源的统计数据、Pixabay/Unsplash/Pexels图片、通过Gemini实现的AI图片生成、内置SVG图表生成、JSON-LD schema生成以及新鲜度信号。支持所有主流平台(WordPress、Next.js MDX、Hugo、Ghost、Astro、Jekyll、11ty、Gatsby、HTML)。当用户提及「博客」「写博客」「博客文章」「博客策略」「内容简报」「编辑日历」「分析博客」「重写博客」「更新博客」「博客SEO」「博客优化」「内容规划」「博客大纲」「SEO检查」「Schema标记」「内容再利用」「GEO审核」「博客审核」「引用就绪」等词汇时即可使用。
借助文本提示词和参考图片,使用Google Gemini AI生成图片。适用于制作游戏资产、概念艺术、UI原型、宣传图片或任何视觉内容。支持文本生成图片、带风格迁移的图片生成图片,以及多种输出尺寸。需要配置GEMINI_API_KEY环境变量。可响应AI图片生成、概念艺术、视觉资产或Gemini图片相关的请求。
通过EachLabs使用OpenAI的GPT Image v2生成并编辑图片。支持文本转图片(gpt-image-v2-text-to-image)和基于指令的编辑(gpt-image-v2-edit)。当用户明确要求使用GPT Image 2/OpenAI图片生成,或需要高保真照片级真实感、精准文本渲染或忠实于参考图的编辑时,可使用此工具。
通过inference.sh CLI使用Google Gemini 3.1 Flash Image Preview(Nano Banana 2)生成图片。功能包括:文本转图片、图片编辑、多图输入(最多14张)、Google搜索 grounding。触发词:nano banana 2、nanobanana 2、gemini 3.1 flash image、gemini 3 1 flash image preview、google image generation
通过inference.sh CLI使用阿里巴巴Qwen-Image-2.0模型生成和编辑图片。可用模型:Qwen-Image-2.0(快速版)、Qwen-Image-2.0-Pro(专业文字渲染版)。功能支持:文本生成图片、多图编辑、复杂文字渲染。触发关键词:qwen image、qwen-image、alibaba image、dashscope image、qwen image 2、qwen image pro
通过inference.sh CLI调用Alibaba Qwen-Image-2.0-Pro生成图片。具备专业文本渲染、精细粒度写实效果、更强的语义贴合能力,非常适合海报、横幅及文字密集型设计。触发词:qwen image pro, qwen-image-pro, qwen 2 pro, alibaba image pro, dashscope pro, professional text rendering
使用Pollinations.ai的免费开源API生成并保存图片。无需注册。支持基于URL的生成方式、自定义参数(宽度、高度、模型、种子值)以及自动文件保存功能。非常适合快速原型制作、营销素材生成和创意工作流。