Loading...
Loading...
共找到 53 个 Skills
通过自由形式的提示词修改视频中的任意内容——背景、场景、光线、服装、天气、氛围,同时精准保留原始的面部特征、动作、语音、音频以及最接近的支持输出比例。使用gpt-image-2编辑第一帧,然后以原始视频作为身份锚点,通过Kling reference-video将该视觉效果传播到整个视频片段。触发词:"change anything in my video"、"edit my video with a prompt"、"change the background of this video"、"change my outfit in this clip"、"restyle this video without changing the person"、"put me on a beach"、"make this video at night"、"/fix-my-look"。
用于海报、关键视觉图和编辑插画的单图生成Skill。默认使用gpt-image-2,但与提供商无关——相同的工作流可通过上游工具驱动Flux、Imagen或Midjourney。输出为一个或多个保存到项目文件夹的PNG/JPEG文件。
使用fal.ai将编码完成的网站升级至获奖级、经专业编辑打磨的设计水准。支持本地HTML文件或开发服务器URL,先对其进行截图,再通过opus-4.7视觉模型编写gpt-image-2编辑提示词,利用fal-ai/gpt-image-2/edit生成重新设计的参考图,随后由opus-4.7视觉模型编写包含「硬约束」章节的Markdown构建规范及tokens.json文件。还支持迭代模式(截图已实现的网站→生成与参考图对比的增量规范)和全新生成模式(需求简述→模型图→单文件HTML)。当用户说出「改进设计」「让它达到世界级水平」「重新设计这个登陆页」「升级这个网站」「设计优化」,或指向本地HTML/开发服务器要求视觉评审时,即可调用该工具。
通过EachLabs使用OpenAI的GPT Image v2生成并编辑图片。支持文本转图片(gpt-image-v2-text-to-image)和基于指令的编辑(gpt-image-v2-edit)。当用户明确要求使用GPT Image 2/OpenAI图片生成,或需要高保真照片级真实感、精准文本渲染或忠实于参考图的编辑时,可使用此工具。
兼容OpenAI的SaaS网关,通过逆向工程chatgpt.com提供GPT Image 2、多账号池、批量图片生成以及账单管理功能。
图片生成技能,当用户需要生成图片、视觉信息图、创建图像、编辑/修改/调整已有图片时使用此技能。基于API易平台(https://api.apiyi.com/)的ChatGPT Image 2模型(gpt-image-2)的官方正式版图片生成服务。该模型支持精确的尺寸/画质控制(含4K),按token计费。与gpt-image-2-all(官逆版)不同的关键点:使用/v1/images/generations和/v1/images/edits端点;有显式size参数;有quality参数;按token计费;使用multipart/form-data上传参考图;b64_json为纯base64无前缀。
先制作一张16格分镜图,再基于该分镜图通过Seedance 2.0图生视频工具生成高镜头密度的动作/打斗场景。整合使用GPT-Image-2(角色设定图+分镜)、Nano-Banana-2(环境概念设计)和Seedance 2.0 i2v工具。
生成、修改、翻译及管理App Store/Google Play营销截图。完整流程包括:初始化.shots工作区,爬取App Store元数据,从代码库与应用列表调研产品,确定主题、配色、受众及竞品环境,保存策略简报,撰写以优势为卖点的标题,通过OpenAI直接调用或fal.ai生成3联GPT-Image 2合成图,再裁剪为可直接上传的面板。支持iPhone、iPad及Android Phone平台。触发词:"app store screenshots"、"marketing screenshots"、"store listing images"、"screenshot generation"、"app store assets"、"google play screenshots"、"shots"、".shots"、"revise shots"、"change screenshots"、"fix panels"、"redo screenshots"、"translate screenshots"、"localize"、"scrape app store"、"fetch metadata"、"import app store"。请勿用于通用图像生成、社交媒体图形或非应用商店营销素材。
一款爆红的AI生成假ESPN本垒后转播镜头:包含转播风格静态画面+15秒Kling-omni视频,搭配两位解说员说出用户姓名的原生解说。固定场景设定:洋基队对阵红袜队的美国联盟冠军系列赛(ALCS)第三场,地点为芬威公园,用户坐在高级座位,画面带有显示用户姓名的计分牌与字幕条。触发指令:“帮我生成本垒后转播镜头”、“生成我的假MLB转播画面”、“AI生成ESPN棒球观众镜头”、“爆红MLB转播特效”、“把我加入洋基红袜的转播镜头”。生成需要用户姓名+一张参考照片。
负责根据提供的内容或参数生成可视化内容并进行视觉重设计:包括绘制、美化、排版、生成、重构论文图表、可视化表格、方法/架构图、图标、调色板,支持参考引导的布局控制,以及生成可编辑的SVG/PDF/PPTX格式文件。可用于结果表格布局优化、色彩/可读性提升、不修改数据的可视化表格重设计、绘图美化、排版、配色、架构图绘制、GPT Image 2生成、参考驱动的构图、纯SVG输出以及可编辑重构。即使是实验结果也可在此进行视觉美化。请勿选择数据集/基线/指标、设计证据语义、编造内容、评审论文、重写散文或将PDF转换为写作范例。
借助genmedia创建个性化的体育直播粉丝镜头视频。可用于制作逼真的观众切镜画面、体育场/竞技场人群反应、直播截图、体育电视镜头、记分牌叠加层、电视频道标识,以及基于用户照片生成的保留身份特征的粉丝反应视频。
基于散文草稿、文章、演讲稿、报告或笔记,创建或更新agegr/mindmap-ppt静态演示项目的内容。当Codex需要将书面文档转换为项目的project/source.js Markdown思维导图数据时使用此功能,选择需要插图的节点,生成或请求符合项目简约演示风格的GPT Image 2插图,将资源放置在project/目录下,并通过npm run check验证结果。