Loading...
Loading...
共找到 28 个 Skills
使用ModelsLab的v7 Video Fusion API,通过文本提示生成视频或让静态图片动起来。支持文本转视频、图片转视频、视频转视频、唇形同步和运动控制功能,涵盖Seedance、Wan、Veo、Sora、Kling和Hailuo等40余种模型。
使用each::sense AI进行视频本地化与配音。翻译音频、生成字幕、克隆语音,为你的视频内容创建多语言唇形同步版本。
通过fal.ai创建会说话的头部视频,并将音频与视频进行唇形同步。适用于解说头像、多语言配音预览以及社交平台短视频制作。
借助each::sense AI生成虚拟主播视频。可通过照片、脚本或音频文件创建AI主持人、唇形同步虚拟形象、企业发言人、培训视频以及多语言内容。
使用TTS、语音克隆和唇形同步工具生成角色语音。支持Chatterbox、F5-TTS、TTS Audio Suite、RVC和ElevenLabs。适用于为角色创建语音音频或实现音视频同步的场景。
通过组合语音克隆、TTS、数字人形象、唇形同步、字幕及增强工具,使用Luma/拾光/拾光智能体/拾光工具生成数字人短视频。
在执行前控制音频生成请求。当用户提出TTS、角色语音、变声、翻译配音、克隆语音录制、播客音频或唇形同步音频移交需求,且技能需要在将执行权移交至voice-batch-runner或视频工作流前对请求进行分类时,使用本技能。
使用RunComfy平台上的字节跳动Seedance 2.0 Pro生成电影风格短视频。本文档介绍了Seedance 2.0 Pro的优势(多模态参考——最多支持9张图片、3个视频、3段音频;同步内通音频与自然唇形同步;电影级运动优化)、4-15秒的时长规范,以及何时转而使用HappyHorse 1.0 / Wan 2.7 / Kling模型。通过本地RunComfy CLI调用`runcomfy run bytedance/seedance-v2/pro`。当出现“seedance”、“seedance 2”、“seedance v2”、“seedance pro”、“bytedance video”或任何明确要求使用该模型生成视频的指令时触发。
通过命令行在RunComfy上运行任意模型。`runcomfy` CLI是一个独立二进制文件,一次认证即可访问数百个模型端点——涵盖图像生成、图像编辑、视频生成、图生视频、唇形同步、人脸替换、视频编辑、图像修复、图像扩展、画面延伸、ControlNet、重新打光、图像超分辨率、LoRA训练等功能。提交请求、轮询状态、下载输出结果。本技能将指导Agent如何安装、认证、发现模型架构、调用模型、流式处理/轮询/无需等待、以JSON输出模式编写脚本以及处理错误。当触发词为“runcomfy cli”、“install runcomfy”、“runcomfy login”、“runcomfy run”、“runcomfy whoami”、“runcomfy api”,或任何明确要求从脚本或终端调用RunComfy模型的请求时,本技能将启动。相关的兄弟技能(ai-image-generation、ai-video-generation、image-edit、video-edit、face-swap、lipsync、image-to-video、image-inpainting、image-outpainting、video-extend、controlnet-pose、relight)均通过此CLI进行调度。
通过inference.sh CLI,使用Google Veo、Seedance、Wan、Grok及40余种模型生成AI视频。支持的模型包括:Veo 3.1、Veo 3、Seedance 1.5 Pro、Wan 2.5、Grok Imagine Video、OmniHuman、Fabric、HunyuanVideo。核心功能:文本转视频、图片转视频、唇形同步、数字人动画、视频画质增强、拟音音效。适用场景:社交媒体视频、营销内容、讲解视频、产品演示、AI数字人。相关关键词:视频生成、AI视频、文本转视频、图片转视频、veo、图片动画、图片生成视频、AI动画、视频生成器、生成视频、t2v、i2v、AI视频制作工具、用AI创建视频、Runway替代工具、Pika替代工具、Sora替代工具、Kling替代工具
通过inference.sh CLI创建AI虚拟形象(AI avatar)和会说话的头部视频。推荐使用:P-Video-Avatar(速度最快、成本最低,内置TTS)。其他可选模型:OmniHuman、Fabric、PixVerse。功能特性:音频驱动虚拟形象、文本生成虚拟形象、唇形同步视频、会说话头部生成、虚拟主持人。适用场景:AI主持人、讲解视频、虚拟网红、配音、营销视频。相关关键词:ai avatar、talking head、lipsync、avatar video、virtual presenter、ai spokesperson、audio driven video、heygen alternative、synthesia alternative、talking avatar、lip sync、video avatar、ai presenter、digital human
通过`runcomfy` CLI在RunComfy上生成AI视频——这是一个覆盖全量视频模型库的智能路由工具,支持的模型包括:HappyHorse 1.0(竞技场排名第1,原生同步音频生成)、Wan-AI Wan 2-7(开源权重,音频驱动唇形同步)、ByteDance Seedance v2/1-5/1-0(多模态电影级)、Kling 3.0/2-6、Google Veo 3-1、MiniMax Hailuo 2-3、ByteDance Dreamina 3-0。支持文本转视频(t2v)、图像转视频(i2v)以及Veo的视频延长端点。该技能会根据用户需求(竞技场顶级质量、多镜头角色一致性、同步音频生成、电影级运镜、最快生成路径、15秒以内片段、最长时长)选择合适的模型,并提供每个模型的官方提示词模板以及最简`runcomfy run`调用指令。当用户输入“generate video”“make a video”“text to video”“t2v”“image to video”“i2v”“animate”“AI video”“make X move”“video from prompt”“video from image”或任何明确要求通过提示词或静态图生成视频片段的指令时,该技能会触发。