Loading...
Loading...
共找到 25 个 Skills
使用RunComfy平台上的字节跳动Seedance 2.0 Pro生成电影风格短视频。本文档介绍了Seedance 2.0 Pro的优势(多模态参考——最多支持9张图片、3个视频、3段音频;同步内通音频与自然唇形同步;电影级运动优化)、4-15秒的时长规范,以及何时转而使用HappyHorse 1.0 / Wan 2.7 / Kling模型。通过本地RunComfy CLI调用`runcomfy run bytedance/seedance-v2/pro`。当出现“seedance”、“seedance 2”、“seedance v2”、“seedance pro”、“bytedance video”或任何明确要求使用该模型生成视频的指令时触发。
针对Model Studio Qwen Omni的轻量多模态全量冒烟测试
当你使用Gemini模型、Gemini API构建应用,处理多模态内容(文本、图片、音频、视频),实现函数调用,使用结构化输出,或需要了解当前模型规格时,可使用本技能。内容涵盖SDK使用(Python的google-genai、JavaScript/TypeScript的@google/genai)、模型选择以及API功能。
针对使用Hugging Face Transformers库进行NLP、计算机视觉和多模态AI任务的专业指导。
This skill should be used when the user asks to "generate video prompts", "create Seedance prompts", "write video descriptions", mentions "Seedance", "seedance", "即梦", "即梦平台", "视频提示词", "视频生成", "AI视频", "短剧", "广告视频", "视频延长", or discusses video prompt engineering, AI video generation, or Seedance 2.0 workflows.
阿里云百炼平台技术文档知识库(LLM Wiki)。当用户查询百炼模型列表、API 参数、错误码、 应用开发(智能体/RAG/知识库/记忆/插件)、模型对比与定价、SDK/OpenAI 兼容接口、 多模态能力(语音/图片/视频)、Token 计费等百炼相关问题时激活。 包含 models 结构化模型市场数据(含 contextWindow/QPM/价格/sample code)、 wiki 合成层(主题页/概念页/对比页)和 raw 原始文档层; 模型规格类问题先查 models/index.md,文档类问题先查 wiki/index.md。
使用@google/genai SDK集成Gemini API(请勿使用已弃用的@google/generative-ai)。支持文本生成、多模态(图片/视频/音频/PDF)、函数调用、思考模式、流式输出。支持100万输入token。可预防14个已记录的错误。 适用场景:Gemini集成、多模态AI、基于思考模式的推理。故障排查:SDK弃用、模型未找到、上下文窗口、函数调用错误、流式输出损坏、安全设置、速率限制。
构建可投入生产的LLM应用、高级RAG系统和智能Agent。实现向量搜索、多模态AI、Agent编排以及企业级AI集成。可主动用于LLM功能、聊天机器人、AI Agent或AI驱动的应用开发。
使用官方Google GenAI SDK(google-genai)为Gemini API和Vertex AI编写Python代码的专业指导。适用于文本生成、多模态输入、推理、工具调用以及媒体生成场景。
使用阿里云百炼模型生成图片、视频、语音,并进行音频转写。
用于基于GLM模型构建应用的Z.ai API集成。在使用Z.ai/ZhipuAI API时可用于以下场景:(1) 借助GLM-4.7/4.6/4.5模型实现对话补全,(2) 借助GLM-4.6V完成视觉/多模态任务,(3) 借助GLM-Image或CogView-4生成图像,(4) 借助CogVideoX-3或Vidu模型生成视频,(5) 借助GLM-ASR-2512实现音频转写,(6) 函数调用与工具使用,(7) 网页搜索集成,(8) 翻译、幻灯片/海报生成Agent。触发关键词:Z.ai、ZhipuAI、GLM、BigModel、Zhipu、CogVideoX、CogView、Vidu。
借助OpenRouter的图像生成模型,根据文本提示生成图像并编辑现有图像。当用户要求根据描述创建、生成图像/图片/插画,或希望通过文本提示编辑、修改、转换现有图像时,可使用此工具。