Loading...
Loading...
共找到 50 个 Skills
通过命令行在RunComfy上运行任意模型。`runcomfy` CLI是一个独立二进制文件,一次认证即可访问数百个模型端点——涵盖图像生成、图像编辑、视频生成、图生视频、唇形同步、人脸替换、视频编辑、图像修复、图像扩展、画面延伸、ControlNet、重新打光、图像超分辨率、LoRA训练等功能。提交请求、轮询状态、下载输出结果。本技能将指导Agent如何安装、认证、发现模型架构、调用模型、流式处理/轮询/无需等待、以JSON输出模式编写脚本以及处理错误。当触发词为“runcomfy cli”、“install runcomfy”、“runcomfy login”、“runcomfy run”、“runcomfy whoami”、“runcomfy api”,或任何明确要求从脚本或终端调用RunComfy模型的请求时,本技能将启动。相关的兄弟技能(ai-image-generation、ai-video-generation、image-edit、video-edit、face-swap、lipsync、image-to-video、image-inpainting、image-outpainting、video-extend、controlnet-pose、relight)均通过此CLI进行调度。
通过`runcomfy` CLI在RunComfy上实现姿态条件生成。可对接Kling 2-6 Motion Control Pro/Standard(将参考视频的动作/分镜转移到目标角色)、社区版Wan 2-2 Animate(带姿态条件的音频驱动角色动画)以及Z-Image Turbo ControlNet LoRA(基于OpenPose/DWPose/边缘检测/深度控制图的姿态条件图像生成)。会根据视频/静态图、风格化/写实风格选择合适的对接路径。当出现"controlnet"、"control net"、"pose control"、"openpose"、"DWPose"、"transfer pose"、"motion control"、"pose driven"、"character pose"、"depth control"、"canny edge"、"use this pose"等关键词,或任何明确要求基于姿态/骨骼/动作/深度/边缘参考进行生成的请求时触发。
这是用于深度学习研究仓库中可审计候选实现的Rigor Improve执行叶技能。当研究人员明确授权在隔离分支或工作树中进行探索性工作时使用,包括移植模块、适配backbone、添加LoRA或adapter层、替换头部,或是将有意义的低风险迁移方案整合在一起,并在`explore_outputs/`目录中记录可回滚的相关信息。请勿将其用于基于`current_research`的端到端探索编排、可信基线复现、保守调试、环境搭建、已验证贡献声明或默认仓库分析。
通过inference.sh CLI使用FLUX、Gemini、Grok、Seedream、Reve等50+模型生成AI图像。支持的模型包括:FLUX Dev LoRA、FLUX.2 Klein LoRA、Gemini 3 Pro Image、Grok Imagine、Seedream 4.5、Reve、ImagineArt。功能涵盖:文本转图像、图像转图像、图像修复、LoRA、图像编辑、图像超分辨率、文本渲染。适用场景:AI艺术创作、产品样机、概念艺术、社交媒体图形、营销视觉素材、插画。相关关键词:flux、图像生成、ai image、text to image、stable diffusion、generate image、ai art、midjourney替代方案、dall-e替代方案、text2img、t2i、图像生成器、ai picture、用AI创建图像、生成式AI、ai插画、grok image、gemini image
调试并同步无人车主控制器(Heltec WiFi LoRa 32)与摄像头模块(ESP32-CAM)之间的通信
使用MLX在Apple Silicon上运行并微调大语言模型(LLM)。适用于在Mac本地运行模型、将Hugging Face模型转换为MLX格式、在Apple Silicon上通过LoRA/QLoRA进行微调,或通过HTTP API部署模型等场景。
提供适用于CTF挑战的人工智能与机器学习技术。可在攻击ML模型、生成对抗样本、执行模型提取、提示词注入、成员推理、训练数据投毒、微调操纵、神经网络分析、LoRA适配器利用、LLM越狱或解决AI相关谜题时使用。
将Anthropic的官方品牌标识(包括配色:深色#141413、浅色#faf9f5、橙色#d97757)、字体规范(Poppins、Lora)及设计标准应用于各类制品、演示文稿、文档和网页界面。当被要求“应用Anthropic品牌风格”“使用品牌配色”“遵循公司规范进行样式设计”“添加Anthropic视觉风格”或“遵循设计标准”时,可使用本技能。本技能提供官方配色方案、字体规格、Logo使用规则及视觉格式规范,适用于HTML制品、演示文稿、PDF、文档及所有需要保持一致品牌标识的视觉交付物。
使用Tinker API微调大语言模型(LLM),内容涵盖监督微调、强化学习、LoRA训练、视觉语言模型,同时包含高层级Cookbook使用模式和低层级API用法。
精通LoRA、QLoRA、数据集准备与训练优化的LLM微调专家
为AI生成的图像和视频提供世界级的角色与艺术风格一致性保障——确保系列作品的视觉连贯性,维持角色辨识度,并在交付前提供严格的QA。当提到“角色一致性、艺术风格、同一角色、连贯角色、视觉连续性、系列、转身图、角色设定表、参考图、角色圣经、风格指南、动漫角色、一致外观、面部一致性、服装一致性、lora训练、ip-adapter、flux kontext、视觉QA、美术质量、生成审核、风格漂移、角色漂移、character-consistency、art-style、visual-qa、ai-art、image-generation、video-generation、anime、illustration、lora、ip-adapter、flux、midjourney、stable-diffusion”等关键词时使用。
SGLang中`moonshotai/Kimi-K2*`和`moonshotai/Kimi-K2.5*`模型的基于PR的当前主分支优化手册。当Codex需要恢复、扩展或审核Kimi相关优化时使用,涵盖K2路由/MoE快速路径、K2思考模式Marlin路径、K2.5包装器/多模态/运行时管线、W4AFP8/W4A16量化轨迹、解析器契约、LoRA覆盖以及后端特定验证。