Loading...
Loading...
共找到 62 个 Skills
Minimal image generation smoke test for Model Studio Qwen image.
基于Gemini Web的图像生成技能。通过Google Gemini根据文本提示生成图像,同时支持文本生成。可作为cover-image、xhs-images、article-illustrator等其他技能的图像生成后端。
为文本和图像模型编写并优化AI生成结果的提示词。适用于为大语言模型(Claude、GPT、Gemini)、图像生成器(Midjourney、DALL-E、Stable Diffusion、Imagen、Flux)或视频生成器(Veo、Runway)设计提示词的场景。内容涵盖提示词结构、风格关键词、负面提示词、思维链、少样本示例、迭代优化,以及适用于营销、代码和创意写作的特定领域模式。
当使用Gemini API(Nano Banana Pro)生成和编辑图像时,应使用此Skill。它适用于通过文本提示创建图像、编辑现有图像、应用风格迁移、生成带文本的标志、制作贴纸、产品样机或任何图像生成/处理任务。支持文本转图像、图像编辑、多轮优化以及基于多张参考图的图像合成。
为DALL-E、Midjourney和Stable Diffusion创建有效的AI图像生成提示词,针对不同风格和使用场景生成提示词。
基于Gemini Web的图像生成技能。通过Google Gemini根据文本提示生成图像,同时支持文本生成。可作为cover-image、xhs-images、article-illustrator等其他技能的图像生成后端。
借助Google Gemini API实现文本生成、多模态分析、图像生成(Nano Banana)、函数调用以及搜索grounding功能。当用户想要使用Gemini、向Gemini提问、用Gemini生成图像或分析内容时,即可调用本功能。
厌倦了同时处理8个API密钥?这个技能让你零配置即可通过单条命令访问Midjourney、Flux、Ideogram等多个工具,当你想要生成任意图片又不想操心API密钥问题时就可以使用它。
当用户需要Claude不具备的功能(图像生成、实时X/Twitter数据)或明确请求外部模型(如“blockrun”、“use grok”、“use gpt”、“dall-e”、“deepseek”)时使用
Google Gemini API图像生成实现指南 - 使用gemini-2.5-flash-image模型通过文本提示生成高质量图像。适用于图像生成、视觉内容创作或实现文本转图像功能的场景。支持文本转图像、图像编辑、多图像合成以及迭代优化。
MiniMax多模态模型技能——使用MiniMax多模态模型处理语音、音乐、视频和图像。借助MiniMax AI创建语音、音乐、视频和图像:TTS(文本转语音、语音克隆、语音设计、多片段)、音乐(歌曲、纯音乐)、视频(文本转视频、图像转视频、首尾帧、主体参考、模板、多场景长视频)、图像(文本转图像、带人物参考的图像转图像),以及媒体处理(格式转换、拼接、裁剪、提取)。当用户提及MiniMax、多模态生成,或需要语音/音乐/视频/图像AI、MiniMax API,或结合MiniMax输出的FFmpeg工作流时使用。
面向图像生成的外部AI API集成,具备重试逻辑、速率限制、内容安全检测及多轮对话支持。