Loading...
Loading...
共找到 4 个 Skills
通过有序的10秒片段构建完整的非写实风格旁白解说视频或故事视频:每个片段包含一位旁白、一个通用风格密钥、一段Seed Audio语音素材和一段Gemini Omni视频片段,随后通过explainer_video进行服务端组装。适用场景:「制作解说视频」、「用视频解释这个内容」、「将这个主题或文档转化为带旁白的视频」、「把这个故事做成动画视频」、「制作无脸旁白视频」或「展示解说视频风格」。支持实时CMS预设、自定义风格参考、吉祥物/无脸模式、两种画幅比例,以及可选的内嵌字幕。不适用场景:写实电影、广告/用户生成内容(UGC)、访谈类视频、播客、动态字幕短片、无旁白的单个片段,或已完成视频的编辑。
通过AnyCap使用Gemini Omni Flash Preview实现实用的短视频编辑工作流。当用户希望通过自然语言指令编辑或优化现有视频时触发,尤其是产品替换、物体移除或替换、重新打光、风格重塑、保留人物/场景同时修改单个元素,或是结合参考图片与源视频进行编辑的场景。内容涵盖`gemini-omni-flash-preview` / `edit-video`的模型/模式探索、提示词构建、AnyCap CLI命令范式、特定场景模板、视频QA以及重试策略。
使用Google Gemini Omni Flash(`gemini-omni-flash-preview`)生成并以对话式方式编辑短视频。适用于以下场景:(1) 使用自然语言编辑迭代剪辑,而非重新生成(例如“让手机消失,其他内容保持不变”);(2) 生成带有合成音频、屏幕渲染文本或时间码节拍的3-10秒720p剪辑;(3) 通过<FIRST_FRAME>/<IMAGE_REF_N>提示标签将参考图像绑定到角色;(4) 编辑已上传的现有视频。可通过项目的GEMINI_API_KEY/GOOGLE_API_KEY访问`gemini_omni_video`工具——该密钥与Imagen和Google TTS通用。
通过多个提供商网关,根据文本提示生成AI视频。适用于以下场景:(1) 根据文本描述生成视频;(2) 为内容制作创建AI生成的视频片段;(3) 基于参考图像的图像转视频生成;(4) 在多个视频生成提供商(VEO、Kling、Sora、Runway、Seedance、MiniMax、Gemini Omni)中进行选择。支持的网关包括:HeyGen API、fal.ai API、Kling官方直连API以及Gemini API(Gemini Omni Flash)。