Loading...
Loading...
共找到 63 个 Skills
HeyGen AI数字人视频创作API。适用场景:(1) 使用/v2/video/generate接口生成AI数字人视频;(2) 使用Video Agent实现一键式文本转视频生成;(3) 处理HeyGen数字人、语音、背景或字幕相关操作;(4) 创建用于合成的透明WebM视频;(5) 查询视频状态或处理Webhook;(6) 将HeyGen与Remotion集成以实现程序化视频制作;(7) 对现有视频进行翻译或配音。
为Kling 3.0 AI视频生成撰写更优质的提示词。适用于用户想要创建、撰写、优化或调整提示词的场景——包括文本转视频、图像转视频、关键帧、多镜头序列或对话场景。
使用该Skill进行AI视频生成。触发词包括:“generate video”、“create video”、“make video”、“animate”、“text to video”、“video from image”、“video of”、“animate image”、“bring to life”、“make it move”、“add motion”、“video with audio”、“video with dialogue”。支持通过Google Veo 3.1(默认)或OpenAI Sora实现文本转视频、图片转视频、带对话/音频的视频生成。
Google Veo 3.1视频生成专家指导。适用于用户需要以下场景时:(1) 创建文本转视频或图像转视频提示词;(2) 优化电影级画质与原生音频同步;(3) 通过参考图像保持角色一致性;(4) 利用时间戳提示词构建多镜头序列;(5) 使用首尾帧插值功能;(6) 在标准和快速生成模式间选择;(7) 排查生成视频中的物理效果、运动或音频问题。
[QianWen] 基于Wan模型生成视频。支持文本转视频(t2v)、图片转视频(i2v)、首尾帧生成(kf2v)、基于参考的角色扮演(r2v)以及视频编辑(VACE)。触发条件:用户想要创建、生成或编辑视频内容,提及视频生成/动画/视频片段/Wan模型,或明确通过名称调用此技能(例如:use qianwen-video-generation)。不触发条件:用户想要生成图片(使用qianwen-image-generation)、理解/分析现有视频(使用qianwen-vision)、仅文本类任务。
为指定任务选择合适的fal.ai端点。按模态分类的生产端点默认目录,涵盖文本转图像、图像转图像、文本转视频、图像转视频等场景。适用于用户未指定具体模型,或询问“做X用哪个模型”“做Y的最佳端点是什么”“做Z应该用什么”的情况。
使用阿里云DashScope API和LingMou生成AI视频与语音。具备七大功能——(1) LivePortrait数字人分身(图片+音频→视频,两步流程),(2) EMO数字人分身,(3) AA/AnimateAnyone全身动画(三步流程),(4) T2I文本生成图片(万相2.x,默认模型wan2.2-t2i-flash),(5) I2V图片生成视频(万相2.x,默认模型wan2.7-i2v-flash,支持T2I→I2V流水线),(6) Qwen TTS语音合成(根据场景自动选择模型/音色,默认模型qwen3-tts-vd-realtime-2026-01-15),(7) LingMou数字人模板视频,支持随机模板、公共模板复制及脚本确认。适用于用户需要数字人分身、肖像动画、全身动画、文本转图片、文本转视频或语音合成的场景。
在Moda平台制作视频与动效:可生成短视频(文本转视频、从Logo、照片或画布帧生成视频、参考引导生成)、品牌片尾动画、动态帖子与广告、Logo动画、视频超分辨率,以及原生矢量动效(动画着色器填充、动画画布导出)。适用于“制作视频”、生成GIF或MP4、制作动态广告/帖子/横幅、动效图形、Logo/图片/设计动效制作,或视频超分辨率处理。moda-video负责所有导出为MP4/GIF的内容——动态社交帖子的动效部分由该技能处理(moda-social负责静态尺寸与格式)。静态帖子/轮播/横幅请使用moda-social;幻灯片请使用moda-deck;实时网站请使用moda-website;对现有画布进行静态编辑请使用moda-edit。视频生成属于计量付费通道;画布动效创作与MP4/GIF导出则无需付费。
通过当前已安装的Media.io CLI生成图片和视频。 可用于文本转图片、图片转图片、文本转视频、图片转视频、参考图转视频,以及`mediaio model list`或`mediaio workflow list`实时输出中显示的已发布工作流。仅当效果的参数已独立验证后才能使用效果,因为当前CLI仅提供`effect list`命令,没有`effect get`命令。 提交前务必确认确切的任务类型和架构。使用易读的发现输出,生成前先上传本地文件,通过`generate create`提交任务,再使用独立的`generate wait`命令等待结果。 在对本地命令网络进行沙箱隔离的主机上,首次执行联网的`mediaio`或`curl` Shell/Bash工具调用前,必须先请求主机批准才能启动进程。切勿在默认沙箱中运行命令来探测网络可用性。
无脸解说视频工作流——任意文本(文章/笔记/主题/简报)→ narrator_scripts.json + 音频(语音+背景音乐BGM)+ section_plan.md → 排版/抽象图形/图表/数据可视化视频。典型时长最多约3分钟(最佳时长约30-90秒);真正更长的视频属于通用视频工作流,而非本工作流。本工作流会自行生成旁白(TTS语音合成)——不支持与用户提供/预录制的画外音同步(该场景属于通用视频工作流)。不包含网站捕获、真实产品截图。若文本提及需推广的产品/其网站,则应使用/product-launch-video工作流;若无法明确是产品类还是主题类内容,请先查看/hyperframes-read-first。
根据文本提示或参考素材生成AI视频。 支持HappyHorse和SeeDance模型。 触发关键词:“生成视频”、“做视频”、“video generation”、“text to video”、“create video”、“视频生成”、“视频编辑”、“video edit”。
通过fal.ai MCP实现统一媒体生成——支持图片、视频和音频。涵盖文本转图片(Nano Banana)、文本/图片转视频(Seedance、Kling、Veo 3)、文本转语音(CSM-1B)以及视频转音频(ThinkSound)。当用户需要用AI生成图片、视频或音频时使用。