Loading...
Loading...
共找到 22 个 Skills
MiniMax多模态模型技能——使用MiniMax多模态模型处理语音、音乐、视频和图像。借助MiniMax AI创建语音、音乐、视频和图像:TTS(文本转语音、语音克隆、语音设计、多片段)、音乐(歌曲、纯音乐)、视频(文本转视频、图像转视频、首尾帧、主体参考、模板、多场景长视频)、图像(文本转图像、带人物参考的图像转图像),以及媒体处理(格式转换、拼接、裁剪、提取)。当用户提及MiniMax、多模态生成,或需要语音/音乐/视频/图像AI、MiniMax API,或结合MiniMax输出的FFmpeg工作流时使用。
为Kling 3.0 AI视频生成撰写更优质的提示词。适用于用户想要创建、撰写、优化或调整提示词的场景——包括文本转视频、图像转视频、关键帧、多镜头序列或对话场景。
Google Veo 3.1视频生成专家指导。适用于用户需要以下场景时:(1) 创建文本转视频或图像转视频提示词;(2) 优化电影级画质与原生音频同步;(3) 通过参考图像保持角色一致性;(4) 利用时间戳提示词构建多镜头序列;(5) 使用首尾帧插值功能;(6) 在标准和快速生成模式间选择;(7) 排查生成视频中的物理效果、运动或音频问题。
为指定任务选择合适的fal.ai端点。按模态分类的生产端点默认目录,涵盖文本转图像、图像转图像、文本转视频、图像转视频等场景。适用于用户未指定具体模型,或询问“做X用哪个模型”“做Y的最佳端点是什么”“做Z应该用什么”的情况。
当用户要求为AI视频生成器(Seedance、Kling、Veo、Runway、Luma、Pika、Sora,或任何图像转视频系统)创建、优化、审核或拆分提示词时,可使用本Skill。该Skill还涵盖故事板、镜头列表、导演阐述、动态蒙太奇、多片段故事结构、镜头调度、灯光设计、场面调度、节奏把控、角色连贯性、台词创作和音效设计。当用户说出类似“придумай сцену для видео”(构思视频场景)、“разбей на склейки”(拆分片段)、“сделай раскадровку”(制作分镜)、“улучши промпт для Kling”(优化Kling的提示词)、“переведи сценарий в промпты”(将剧本转换为提示词)、“как снять X в AI-видео”(如何在AI视频中拍摄X)这类语句,或是分享提示词并要求修改时,也触发本Skill。
使用Seedream 5.0 Pro分镜脚本和Seedance 2.0规划并生成可控的Seedance视频,待Seedance 2.5可用时可切换至该路线。适用于生成人物、产品、物品、食物或场景保持一致的内容;支持分镜转视频、参考素材转视频、首尾帧图像转视频、视频延长以及Atlas Cloud媒体生成。
将面向时尚领域的FASHN生成式图像与视频模型集成到项目中,或直接在线运行。可通过FASHN REST API、TypeScript SDK(npm包fashn)或Python SDK(pip包fashn)实现虚拟试穿、商品转模特上身、模特创建/替换、人脸转模特、编辑、重构图、背景移除以及图像转视频等功能。
在RunComfy上将任意静态图片动起来——该技能是一个智能路由工具,可将用户意图与RunComfy模型库中合适的i2v模型进行匹配。针对通用动画场景选择HappyHorse 1.0 I2V(竞技场排名第1,支持原生音频、身份保留);针对自定义旁白唇形同步场景选择带`audio_url`参数的Wan 2.7;针对图像+参考视频+参考音频的多模态动画场景选择Seedance 2.0 Pro。该技能整合了每个模型的文档提示模板,让调用者无需在错误模型上反复尝试即可获得更优质的输出。通过本地RunComfy CLI调用`runcomfy run <vendor>/<model>/image-to-video`(或其端点变体)。当触发词为"image to video"、"image-to-video"、"i2v"、"animate image"、"make this move"或任何明确要求将静态图转为视频的指令时,该技能启动。
MassGen中的视频生成指南。适用于通过Grok、Google Veo、OpenAI Sora多个后端,从文本提示或图像创建视频的场景。
使用Kling 3.0、Hailuo、Luma Ray3、Runway Gen-4.5及另外8款工具将静态图片生成AI视频。涵盖免费与付费工具对比、仅描述动作的提示词撰写、相机控制以及面部稳定性等内容。适用于用户要求将图片动效化、创建AI视频或把照片转为视频的场景。