Loading...
Loading...
共找到 330 个 Skills
在RunComfy上使用Wan 2.7(Wan-AI的旗舰运动模型)生成文本转视频。本文档介绍了Wan 2.7的优势(多参考条件控制、通过`audio_url`实现音频驱动的唇形同步、更流畅的转场、提示词扩展)、时长/分辨率/宽高比规范,以及何时转而使用HappyHorse 1.0 / Seedance 2.0 / Kling / LTX 2。通过本地RunComfy CLI调用`runcomfy run wan-ai/wan-2-7/text-to-video`。当触发词为"wan"、"wan 2.7"、"wan-2-7"、"wan video"或任何明确要求使用该模型生成视频的请求时执行。
使用RunComfy平台上的字节跳动Seedance 2.0 Pro生成电影风格短视频。本文档介绍了Seedance 2.0 Pro的优势(多模态参考——最多支持9张图片、3个视频、3段音频;同步内通音频与自然唇形同步;电影级运动优化)、4-15秒的时长规范,以及何时转而使用HappyHorse 1.0 / Wan 2.7 / Kling模型。通过本地RunComfy CLI调用`runcomfy run bytedance/seedance-v2/pro`。当出现“seedance”、“seedance 2”、“seedance v2”、“seedance pro”、“bytedance video”或任何明确要求使用该模型生成视频的指令时触发。
在RunComfy上使用HappyHorse 1.0生成文本转视频。本文档介绍了HappyHorse 1.0的优势(在Artificial Analysis Video Arena排名第一、原生1080p分辨率并支持生成过程同步音频、多镜头角色一致性、支持6种语言提示词)、时长/宽高比/分辨率配置规则,以及何时转而使用Wan 2.7/Seedance 2/LTX 2。通过本地RunComfy CLI调用`runcomfy run happyhorse/happyhorse-1-0/text-to-video`。当触发词为“happyhorse”、“happy horse”、“happyhorse 1.0”、“happyhorse video”或任何明确要求使用该模型生成视频的请求时执行。
在RunComfy上使用Kling 3.0生成视频。Kling 3.0(也称为Kling V3.0)是快手科技推出的第三代多镜头视频模型,具备原生同步音频功能,且镜头间角色身份保持一致。该技能涵盖Kling 3.0的全部6个端点,包含三种渲染等级(Standard、Pro、4K)和两种模式(text-to-video文本转视频、image-to-video图像转视频)。可通过本地RunComfy CLI调用`runcomfy run kling/kling-3.0/<tier>/<mode>`命令。当触发词为“kling”、“kling 3.0”、“kling v3”、“kling pro”、“kling 4k”、“kling text to video”、“kling image to video”,或任何明确要求使用Kling 3.0生成或制作动画的请求时,将启动该技能。
通过`runcomfy` CLI在RunComfy上创建AI头像、虚拟主播(Talking-Head)及唇同步视频。支持调用字节跳动OmniHuman(音频驱动全身头像)、万智源Wan 2-7(通过`audio_url`实现人像音频驱动嘴部同步)、HappyHorse 1.0(竞技场排名第一的文本转视频/图像转视频,支持内置音频)以及Seedance v2 Pro(多模态影视级生成,支持参考音频+参考主体)等模型。会根据用户的实际需求——UGC旁白、虚拟主持人、配音产品演示、唇同步角色、对话场景——选择合适的模型,并提供各模型的文档化提示模板以及最简`runcomfy run`调用指令。当用户提及“talking head”“lip sync”“avatar video”“让X说话”“audio to video”“audio driven avatar”“virtual presenter”“AI spokesperson”“dubbed video”“UGC avatar”“HeyGen替代方案”“Synthesia替代方案”“digital human”“让这张人像说话”“从旁白生成视频”或任何明确要求让面部开口说话的请求时,该功能将触发。
通过`runcomfy` CLI在RunComfy上实现姿态条件生成。可对接Kling 2-6 Motion Control Pro/Standard(将参考视频的动作/分镜转移到目标角色)、社区版Wan 2-2 Animate(带姿态条件的音频驱动角色动画)以及Z-Image Turbo ControlNet LoRA(基于OpenPose/DWPose/边缘检测/深度控制图的姿态条件图像生成)。会根据视频/静态图、风格化/写实风格选择合适的对接路径。当出现"controlnet"、"control net"、"pose control"、"openpose"、"DWPose"、"transfer pose"、"motion control"、"pose driven"、"character pose"、"depth control"、"canny edge"、"use this pose"等关键词,或任何明确要求基于姿态/骨骼/动作/深度/边缘参考进行生成的请求时触发。
通过`runcomfy` CLI在RunComfy上扩展或续接现有视频片段。该功能会调用Google Veo 3-1的`extend-video`和`fast/extend-video`端点——选择源视频并输入描述后续内容的提示词,模型就能生成与原视频在动作、光线和主体身份上保持一致的续接片段。适用于用户拥有较短Veo片段并想要延长时长,或者希望以单个种子片段为基础逐镜头构建连贯叙事的场景。当用户提出“extend video”“continue video”“longer video”“video extend”“make this clip longer”“Veo extend”“chain video shots”“video continuation”等明确要求,即对现有视频添加更多帧时,触发该功能。
pr-to-video 工作流 - 将 GitHub Pull Request(URL 格式如 github.com/<owner>/<repo>/pull/<N>,或 <owner>/<repo>#<N>,或已检出仓库中的“this PR”)→ 提取 PR 信息(标题、正文、差异、提交记录、文件、增减行数统计)→ 生成 narrator_scripts.json + 音频(语音 + 背景音乐)+ section_plan.md → 最终输出代码差异/前后对比/影响说明视频。输入为代码变更内容。URL 必须是 PR 链接,而非可抓取的营销网站;也不能是文本简介或产品网站。若输入非 PR 内容(如产品网站、通用网站、主题文本),请查看 /hyperframes-read-first。
通过Higgsfield AI借助30余种模型生成图片和视频,这些模型包括Nano Banana 2、Soul V2、Veo 3.1、Kling 3.0、Seedance 2.0、Flux 2、GPT Image 2等,此外还有Marketing Studio可用于制作带有定制化虚拟形象和导入产品的品牌广告视频/图片。 适用场景:"生成图片"、"制作画作"、"创作艺术作品"、"制作视频"、"将照片动画化"、"image-to-video"、"img2vid"、"用AI编辑图片"、"为照片添加风格"、"重新创作图片"、"制作片段"、"渲染场景"、"制作广告"、"制作UGC视频"、"生成营销视频"、"制作产品演示"、"制作开箱视频"、"电视广告"、"虚拟试穿"、"产品展示"、"品牌视频"、"产品演示人视频"、"从URL导入产品"、"为广告创建虚拟形象"。 支持text-to-image、image-to-image、image-to-video、基于参考的生成,以及Marketing Studio(虚拟形象+产品+广告模式)。 可自动检测传入的ID是上传文件还是过往任务ID。 当用户希望输出内容中包含自己的面部时,可与higgsfield-soul-id配合使用。 不适用场景:训练Soul Character(请使用higgsfield-soul-id)、带有模式特定提示增强的专业产品拍摄(请使用higgsfield-product-photoshoot)、纯文本/聊天/TTS任务。
通过`runcomfy` CLI在RunComfy上生成AI视频——这是一个覆盖全量视频模型库的智能路由工具,支持的模型包括:HappyHorse 1.0(竞技场排名第1,原生同步音频生成)、Wan-AI Wan 2-7(开源权重,音频驱动唇形同步)、ByteDance Seedance v2/1-5/1-0(多模态电影级)、Kling 3.0/2-6、Google Veo 3-1、MiniMax Hailuo 2-3、ByteDance Dreamina 3-0。支持文本转视频(t2v)、图像转视频(i2v)以及Veo的视频延长端点。该技能会根据用户需求(竞技场顶级质量、多镜头角色一致性、同步音频生成、电影级运镜、最快生成路径、15秒以内片段、最长时长)选择合适的模型,并提供每个模型的官方提示词模板以及最简`runcomfy run`调用指令。当用户输入“generate video”“make a video”“text to video”“t2v”“image to video”“i2v”“animate”“AI video”“make X move”“video from prompt”“video from image”或任何明确要求通过提示词或静态图生成视频片段的指令时,该技能会触发。
当用户希望使用AI工具或程序化框架创建、生成或制作视频内容时适用。当用户提及以下关键词时也适用:'video production'、'AI video'、'Remotion'、'Hyperframes'、'HeyGen'、'Synthesia'、'Veo'、'Runway'、'Kling'、'Pika'、'video generation'、'AI avatar'、'talking head video'、'programmatic video'、'video template'、'explainer video'、'product demo video'、'video pipeline'或'make me a video'。此内容适用于视频创建、生成和制作工作流。如需视频内容策略及发布建议,请查看social-content;如需付费视频广告创意,请查看ad-creative。
通过有序的10秒片段构建完整的非写实风格旁白解说视频或故事视频:每个片段包含一位旁白、一个通用风格密钥、一段Seed Audio语音素材和一段Gemini Omni视频片段,随后通过explainer_video进行服务端组装。适用场景:「制作解说视频」、「用视频解释这个内容」、「将这个主题或文档转化为带旁白的视频」、「把这个故事做成动画视频」、「制作无脸旁白视频」或「展示解说视频风格」。支持实时CMS预设、自定义风格参考、吉祥物/无脸模式、两种画幅比例,以及可选的内嵌字幕。不适用场景:写实电影、广告/用户生成内容(UGC)、访谈类视频、播客、动态字幕短片、无旁白的单个片段,或已完成视频的编辑。