Loading...
Loading...
共找到 6 个 Skills
用于视频旁白的ElevenLabs TTS集成方案。适用于生成旁白音频、选择语音或构建脚本转音频流水线场景
使用AI虚拟形象、唇形同步和语音旁白制作会说话的头部视频。涵盖肖像要求、音频质量、OmniHuman、PixVerse唇形同步、Dia TTS等内容。适用场景:代言人视频、课程内容、社交媒体、演示文稿、产品演示。相关关键词:会说话的头部视频、虚拟形象视频、唇形同步、AI代言人、虚拟主持人、AI主持人、OmniHuman、会说话的虚拟形象、视频主持人、AI会说话的头部视频、主持人视频、AI人脸视频
使用自定义LLM、TTS引擎、感知功能和话轮转换来配置Tavus CVI角色。适用于自定义AI行为、接入自有LLM、配置语音/TTS、通过Raven启用视觉功能或通过Sparrow调整对话流程等场景。
当用户给出一个主题,希望生成自动化的主题驱动型旁白讲解视频、播客或知识总结视频(适用于B站/YouTube/小红书/抖音/视频号),或者要求从参考视频/图片中学习视觉设计模式时,可使用本技能。当用户提及要基于某个主题创建知识视频、旁白讲解视频、视频播客或头部出镜主题视频时触发——即使他们没有明确说出“视频播客”一词。请勿用于通用视频剪辑、裁剪、格式转换、调色或非叙事类视频任务。通过「调研→脚本→TTS→Remotion→MP4+背景音乐」流程生成4K视频。
使用AI从零开始生成多人对话式头部特写播客视频——涵盖角色创建、文本转语音(TTS)、虚拟形象动画和视频拼接功能。适用于用户想要创建播客、对话式头部特写视频或多发言人对话视频的场景。
一款工作流编排器,可根据文章、脚本或旁白素材创建由内容驱动的演示文稿/视频HTML。当用户希望将文字转换为HTML幻灯片、旁白视频、同步字幕或浏览器录制的教学视频时,可搭配视觉约束检查工具使用。该技能通过持久化文件管理整个流程:article.md → content-understanding.md → theme-extraction.md → storyboard.md → slide-specs/ → visual-logic.md → deck.html → audio/ → subtitles.srt → output.mp4。它首先确保内容被正确理解,仅从用户选择的主题技能中借用主题标记,让布局和动画由内容而非模板决定。