Loading...
Loading...
共找到 22 个 Skills
在RunComfy上使用Kling 3.0生成视频。Kling 3.0(也称为Kling V3.0)是快手科技推出的第三代多镜头视频模型,具备原生同步音频功能,且镜头间角色身份保持一致。该技能涵盖Kling 3.0的全部6个端点,包含三种渲染等级(Standard、Pro、4K)和两种模式(text-to-video文本转视频、image-to-video图像转视频)。可通过本地RunComfy CLI调用`runcomfy run kling/kling-3.0/<tier>/<mode>`命令。当触发词为“kling”、“kling 3.0”、“kling v3”、“kling pro”、“kling 4k”、“kling text to video”、“kling image to video”,或任何明确要求使用Kling 3.0生成或制作动画的请求时,将启动该技能。
通过`runcomfy` CLI在RunComfy上生成AI视频——这是一个覆盖全量视频模型库的智能路由工具,支持的模型包括:HappyHorse 1.0(竞技场排名第1,原生同步音频生成)、Wan-AI Wan 2-7(开源权重,音频驱动唇形同步)、ByteDance Seedance v2/1-5/1-0(多模态电影级)、Kling 3.0/2-6、Google Veo 3-1、MiniMax Hailuo 2-3、ByteDance Dreamina 3-0。支持文本转视频(t2v)、图像转视频(i2v)以及Veo的视频延长端点。该技能会根据用户需求(竞技场顶级质量、多镜头角色一致性、同步音频生成、电影级运镜、最快生成路径、15秒以内片段、最长时长)选择合适的模型,并提供每个模型的官方提示词模板以及最简`runcomfy run`调用指令。当用户输入“generate video”“make a video”“text to video”“t2v”“image to video”“i2v”“animate”“AI video”“make X move”“video from prompt”“video from image”或任何明确要求通过提示词或静态图生成视频片段的指令时,该技能会触发。
通过inference.sh CLI使用ByteDance Seedance 2.0模型生成视频。模型包括:Seedance 2 T2V、Seedance 2 I2V、Seedance 2 R2V。功能:文本转视频、图像转视频、参考素材转视频、同步音频、质量/快速模式、480p/720p分辨率。适用场景:社交媒体视频、音乐视频、产品演示、动画内容、带音效的AI视频。相关关键词:seedance、seedance 2、bytedance video、seedance t2v、seedance i2v、seedance r2v、video with audio、seedance 2.0、bytedance seedance
通过Starchild付费代理,基于fal.ai实现端到端视频生成。涵盖文本转视频、图像转视频、视频转视频、模型选择、计费、轮询以及通过公开预览服务本地参考资产等内容。
通过AceDataCloud API使用Luma Dream Machine生成AI视频。适用于根据文本提示创建视频、根据参考图像生成视频、扩展现有视频,或任何使用Luma的视频生成任务。支持文本转视频、图像转视频和视频扩展功能。
通过AceDataCloud API使用快手Kling生成AI视频。适用于从文本或图像创建视频、扩展现有视频、应用运动控制、将图像+音频生成交话照片,或为视频进行音频/文本唇形同步。支持文本转视频、图像转视频、视频扩展、运动生成、对话照片和唇形同步功能,提供多种模型和质量模式。
通过AceDataCloud API借助OpenAI Sora生成AI视频。适用于从文本提示创建视频、从参考图像生成视频,或使用现有视频中的角色参考场景。支持文本转视频、图像转视频以及基于角色的生成,提供多种模型和分辨率选项。
通用AI视频生成工具,支持OpenAI Sora、Google Veo 2/3、Runway Gen-3/Gen-4、Pika 2.2、Luma Dream Machine(Ray 2)、FAL(Kling/Wan/Veo/Sora封装)、Ark Seedance 1.5 Pro/Lite、百炼万相(i2v)、MiniMax 海螺-02以及Vidu Q3。当用户要求根据文本提示或首帧图像生成、创建、制作或合成视频时,使用此技能。支持文本转视频和图像转视频,部分支持的提供商还可选末帧控制。典型触发语句包括“generate a video of ...”“make a 5-second clip of ...”“animate this image”“生成一段视频”“做个短片”,或提及任何视频生成模型系列,如Sora、Veo、Runway Gen、Kling、Wan、Seedance、海螺、Pika、Dream Machine、Vidu。即使用户未指定具体模型,也需使用此技能——从其EXTEND.md默认配置或可用API密钥中选择提供商。若用户明确提及即梦/Dreamina/Jimeng,则不要使用此技能,应转至happy-dreamina。
帮助用户集成Runway视频生成API(文本转视频、图像转视频、视频转视频)
通过多个提供商网关,根据文本提示生成AI视频。适用于以下场景:(1) 根据文本描述生成视频;(2) 为内容制作创建AI生成的视频片段;(3) 基于参考图像的图像转视频生成;(4) 在多个视频生成提供商(VEO、Kling、Sora、Runway、Seedance、MiniMax、Gemini Omni)中进行选择。支持的网关包括:HeyGen API、fal.ai API、Kling官方直连API以及Gemini API(Gemini Omni Flash)。
通过`runcomfy` CLI在RunComfy上创建AI头像、虚拟主播(Talking-Head)及唇同步视频。支持调用字节跳动OmniHuman(音频驱动全身头像)、万智源Wan 2-7(通过`audio_url`实现人像音频驱动嘴部同步)、HappyHorse 1.0(竞技场排名第一的文本转视频/图像转视频,支持内置音频)以及Seedance v2 Pro(多模态影视级生成,支持参考音频+参考主体)等模型。会根据用户的实际需求——UGC旁白、虚拟主持人、配音产品演示、唇同步角色、对话场景——选择合适的模型,并提供各模型的文档化提示模板以及最简`runcomfy run`调用指令。当用户提及“talking head”“lip sync”“avatar video”“让X说话”“audio to video”“audio driven avatar”“virtual presenter”“AI spokesperson”“dubbed video”“UGC avatar”“HeyGen替代方案”“Synthesia替代方案”“digital human”“让这张人像说话”“从旁白生成视频”或任何明确要求让面部开口说话的请求时,该功能将触发。
使用Google的Veo 2和Veo 3模型创建和编辑视频。支持文本转视频、图像转视频、参考图转视频、视频修复(Inpainting)和视频延长功能。可用参数包括:prompt、image、mask、mode、duration、aspect-ratio。运行前请务必与用户确认参数,或明确说明默认值。