Loading...
Loading...
共找到 25 个 Skills
创建持久化的HeyGen头像——为Agent、用户或任何指定角色打造可复用的面部+语音身份,由HeyGen Avatar V技术提供支持。默认采用基于提示词的创建方式(描述内容→由HeyGen生成);若要创建真人数字孪生,可选择上传照片。 适用场景:(1) 为Agent赋予面部+语音使其能呈现视频(如“让自己形象化”“创建你的头像”“为自己设置头像”“设计一位演示者”“搭建头像”“我们来制作一个头像”);(2) 用户希望以自身形象出现在视频中(如“创建我的头像”“我想让我的脸出现在视频里”“我的数字孪生体”“为我制作一个头像”);(3) 打造指定角色的演示者(如“创建名为Cleo的头像”“设计名为X的角色”);(4) 在制作视频前先建立HeyGen身份——当尚无头像时的正确第一步操作。 链式信号:当用户在同一请求中同时提及身份/头像操作和视频操作(如“创建头像并制作视频”“设置身份然后创建视频”“设计演示者并立即录制”),先运行heygen-avatar,再运行heygen-video。 返回avatar_id + voice_id——可直接传递给heygen-video以创建HeyGen视频。 不适用场景:生成视频(请使用heygen-video)、视频翻译或仅文本转语音(TTS)任务。
HeyGen - AI虚拟人视频创建API最佳实践。适用于创建AI虚拟人视频、生成说话人头视频,或集成HeyGen与Remotion的场景。
通过v3 Video Agent管道生成HeyGen主持人视频——可处理帧检查(宽高比校正)、提示词工程、虚拟形象解析以及语音选择。适用于所有HeyGen视频生成场景,以v3版本替代已弃用的端点。适用场景:(1) 生成任意HeyGen视频(通过API或其他方式);(2) 发送个性化视频消息(客户开发、更新通知、公告、推销、知识分享);(3) 创建由HeyGen主持人主导的带有人脸的讲解视频、教程或产品演示;(4) 诸如“制作我讲述...的视频”“给我的潜在客户发送视频”“为我的团队录制更新视频”“创建推销视频”“制作Loom风格消息视频”“我想出现在这个视频里”“生成HeyGen视频”“制作头部特写视频”等需求。支持从heygen-avatar获取avatar_id以生成基于身份的HeyGen视频,也可使用库存主持人。返回视频分享URL及用于迭代的HeyGen会话URL。链式触发信号:当用户在同一请求中既想创建/设计虚拟形象又想制作视频时,先运行heygen-avatar,再回到此流程。需关注的连接词:“and then”“and immediately”“first...then”“X and make a video”“design [presenter] and record”——这些情况均需触发链式流程。若用户提供照片并想要制作视频,先引导至heygen-avatar。不适用场景:虚拟形象创建或身份设置(请先使用heygen-avatar)、无主持人的电影片段或B-roll、视频翻译、仅文本转语音(TTS)或流式虚拟形象。
可从任意素材(文档、更新日志、博客文章、笔记、文字稿)生成虚拟主播视频。借助HeyGen v2 API制作多场景视频,实现虚拟头像在截图/图片上进行旁白解说。支持Quick Shot(快速拍摄)和Full Producer(全流程制作)两种模式。
通过inference.sh CLI创建AI虚拟形象(AI avatar)和会说话的头部视频。推荐使用:P-Video-Avatar(速度最快、成本最低,内置TTS)。其他可选模型:OmniHuman、Fabric、PixVerse。功能特性:音频驱动虚拟形象、文本生成虚拟形象、唇形同步视频、会说话头部生成、虚拟主持人。适用场景:AI主持人、讲解视频、虚拟网红、配音、营销视频。相关关键词:ai avatar、talking head、lipsync、avatar video、virtual presenter、ai spokesperson、audio driven video、heygen alternative、synthesia alternative、talking avatar、lip sync、video avatar、ai presenter、digital human
通过inference.sh CLI,借助OmniHuman、Fabric、PixVerse创建AI头像和会说话的头部视频。支持模型:OmniHuman 1.5、OmniHuman 1.0、Fabric 1.0、PixVerse Lipsync。功能特性:音频驱动头像、唇形同步视频、会说话的头部生成、虚拟主持人。适用场景:AI主持人、讲解视频、虚拟网红、配音、营销视频。相关关键词:AI头像、会说话的头部、唇形同步、头像视频、虚拟主持人、AI发言人、音频驱动视频、Heygen替代方案、Synthesia替代方案、会说话的头像、唇形同步、视频头像、AI主持人、数字人
通过inference.sh CLI使用Pruna P-Video-Avatar生成说话头像视频。借助内置TTS将肖像图片转化为逼真的说话视频。速度比竞品快18倍,成本低6倍。模型包括:P-Video-Avatar、P-Image(用于生成肖像)。功能:文本转头像、音频驱动头像、30种音色、10种语言、720p/1080p分辨率、内置TTS、动态背景、全身控制。适用场景:AI主持人、产品演示、讲解视频、虚拟网红、营销、教育、多语言内容、UGC、游戏头像。相关关键词:avatar video、talking head、AI avatar、P-Video-Avatar、Pruna avatar、video avatar、AI presenter、数字人、virtual presenter、唇同步、talking avatar、AI发言人、HeyGen替代方案、Synthesia替代方案、Veed替代方案、Fabric替代方案、OmniHuman替代方案
端到端构建LiveAvatar集成——评估用户现有技术栈,推荐最优路径并指导实施。适用于以下场景:(1) 构建新的LiveAvatar集成;(2) 为应用或网站添加实时虚拟形象;(3) 将LiveAvatar连接至现有AI管道;(4) 用户提及LiveAvatar、实时虚拟形象、交互式虚拟形象、对话式虚拟形象或唇形同步虚拟形象;(5) 在Embed、FULL Mode和LITE Mode之间做选择;(6) 从HeyGen Interactive Avatar迁移至LiveAvatar。
通过visual-style.md文件创建、提取和应用可移植的视觉设计系统。适用于以下场景:(1) 从零开始创建visual-style.md设计系统;(2) 从网站URL、视频或PDF品牌指南中提取视觉风格;(3) 将视觉风格应用于HeyGen视频、HTML幻灯片、Figma或paper.design;(4) 浏览预构建视觉风格图库(如瑞士风格、Saul Bass风格、Game Boy风格等);(5) 用户提及"视觉风格"、"设计系统"、"品牌风格"或"风格指南";(6) 使用统一的设计语言为HeyGen视频设置样式。
长视频转Shorts+静音字幕迷你技能(工具包括Opus Clip / CapCut / Submagic)。适用于以下场景:将播客/网络研讨会/长视频剪辑为Shorts、从YouTube视频制作TikToks/Reels、为视频添加字幕、将长内容重制为短视频、自动生成剪辑片段。流程为:工具完成剪辑和字幕制作,人工审核,最后由WoopSocial安排发布。该技能隶属于ai-video路由,与veo-3、heygen、ai-voiceover为同级技能。核心分工逻辑:将Opus Clip专属流程(credits、Virality Score、服务层级)交由opus-clip技能处理,手动短视频剪辑交由capcut技能处理,长视频访谈剪辑则交由descript处理。导出内容需无水印,并标注AI编辑视频。
通过多个提供商网关,根据文本提示生成AI视频。适用于以下场景:(1) 根据文本描述生成视频;(2) 为内容制作创建AI生成的视频片段;(3) 基于参考图像的图像转视频生成;(4) 在多个视频生成提供商(VEO、Kling、Sora、Runway、Seedance、MiniMax、Gemini Omni)中进行选择。支持的网关包括:HeyGen API、fal.ai API、Kling官方直连API以及Gemini API(Gemini Omni Flash)。
当用户希望使用AI工具或程序化框架创建、生成或制作视频内容时适用。当用户提及以下关键词时也适用:'video production'、'AI video'、'Remotion'、'Hyperframes'、'HeyGen'、'Synthesia'、'Veo'、'Runway'、'Kling'、'Pika'、'video generation'、'AI avatar'、'talking head video'、'programmatic video'、'video template'、'explainer video'、'product demo video'、'video pipeline'或'make me a video'。此内容适用于视频创建、生成和制作工作流。如需视频内容策略及发布建议,请查看social-content;如需付费视频广告创意,请查看ad-creative。