Loading...
Loading...
共找到 51 个 Skills
通过inference.sh CLI使用FLUX、Gemini、Grok、Seedream、Reve等50+模型生成AI图像。支持的模型包括:FLUX Dev LoRA、FLUX.2 Klein LoRA、Gemini 3 Pro Image、Grok Imagine、Seedream 4.5、Reve、ImagineArt。功能涵盖:文本转图像、图像转图像、图像修复、LoRA、图像编辑、图像超分辨率、文本渲染。适用场景:AI艺术创作、产品样机、概念艺术、社交媒体图形、营销视觉素材、插画。相关关键词:flux、图像生成、ai image、text to image、stable diffusion、generate image、ai art、midjourney替代方案、dall-e替代方案、text2img、t2i、图像生成器、ai picture、用AI创建图像、生成式AI、ai插画、grok image、gemini image
通过inference.sh CLI,使用Google Veo、Seedance、Wan、Grok及40余种模型生成AI视频。支持的模型包括:Veo 3.1、Veo 3、Seedance 1.5 Pro、Wan 2.5、Grok Imagine Video、OmniHuman、Fabric、HunyuanVideo。核心功能:文本转视频、图片转视频、唇形同步、数字人动画、视频画质增强、拟音音效。适用场景:社交媒体视频、营销内容、讲解视频、产品演示、AI数字人。相关关键词:视频生成、AI视频、文本转视频、图片转视频、veo、图片动画、图片生成视频、AI动画、视频生成器、生成视频、t2v、i2v、AI视频制作工具、用AI创建视频、Runway替代工具、Pika替代工具、Sora替代工具、Kling替代工具
通过inference.sh CLI运行250+款AI应用——涵盖图像生成、视频创作、大语言模型(LLMs)、搜索、3D建模、Twitter自动化等功能。支持的模型包括:FLUX、Veo、Gemini、Grok、Claude、Seedance、OmniHuman、Tavily、Exa、OpenRouter等众多模型。适用于运行AI应用、生成图像/视频、调用LLMs、网页搜索或自动化Twitter操作场景。触发关键词:inference.sh、infsh、ai model、run ai、serverless ai、ai api、flux、veo、claude api、image generation、video generation、openrouter、tavily、exa search、twitter api、grok
通过inference.sh CLI运行250+款AI应用——涵盖图像生成、视频创作、大语言模型(LLMs)、搜索、3D建模、Twitter自动化等。支持的模型包括FLUX、Veo、Gemini、Grok、Claude、Seedance、OmniHuman、Tavily、Exa、OpenRouter等众多模型。适用于运行AI应用、生成图像/视频、调用LLMs、网页搜索或自动化Twitter操作场景。触发关键词:inference.sh、infsh、ai model、run ai、serverless ai、ai api、flux、veo、claude api、image generation、video generation、openrouter、tavily、exa search、twitter api、grok
通过inference.sh CLI创建AI虚拟形象(AI avatar)和会说话的头部视频。推荐使用:P-Video-Avatar(速度最快、成本最低,内置TTS)。其他可选模型:OmniHuman、Fabric、PixVerse。功能特性:音频驱动虚拟形象、文本生成虚拟形象、唇形同步视频、会说话头部生成、虚拟主持人。适用场景:AI主持人、讲解视频、虚拟网红、配音、营销视频。相关关键词:ai avatar、talking head、lipsync、avatar video、virtual presenter、ai spokesperson、audio driven video、heygen alternative、synthesia alternative、talking avatar、lip sync、video avatar、ai presenter、digital human
通过inference.sh CLI使用Google Gemini原生图像模型生成图片。支持模型:Gemini 3 Pro Image、Gemini 2.5 Flash Image。功能:文本生成图像、图像编辑、多图像输入。触发词:nano banana、gemini image、gemini 3 pro image、gemini 2.5 flash image、google image generation、native image generation、gemini native image
通过inference.sh CLI使用Google Gemini 3.1 Flash Image Preview(Nano Banana 2)生成图片。功能包括:文本转图片、图片编辑、多图输入(最多14张)、Google搜索 grounding。触发词:nano banana 2、nanobanana 2、gemini 3.1 flash image、gemini 3 1 flash image preview、google image generation
ElevenLabs文本转语音服务,拥有22+种优质语音、多语言支持,可通过inference.sh CLI进行语音调优。模型包括:eleven_multilingual_v2(最高音质)、eleven_turbo_v2_5(低延迟)、eleven_flash_v2_5(超快速)。功能:文本转语音、语音选择、稳定性/风格控制、支持32种语言。适用场景:旁白配音、有声书、视频解说、播客、无障碍服务、交互式语音应答(IVR)。触发词:elevenlabs、eleven labs、elevenlabs tts、premium tts、professional voice、ai voice、high quality tts、multilingual tts、eleven labs voice、voice generation、natural speech、realistic voice、voice over、speech synthesis
ElevenLabs AI音乐生成 - 通过inference.sh CLI根据文本提示创作原创音乐。功能特性:文本转音乐、自定义时长最长10分钟、可控制流派/情绪/乐器、可免费商用无版权限制。适用场景:背景音乐、影视原声、广告短曲、播客、视频配乐、游戏音频。触发关键词:elevenlabs music, eleven labs music, ai music, generate music, music generation, compose music, ai composer, create song, soundtrack, background music, jingle, elevenlabs compose, music ai
通过inference.sh CLI使用Real-ESRGAN、Thera、Topaz、FLUX Upscaler对图像进行放大和增强。 模型:Real-ESRGAN、Thera(支持任意尺寸)、FLUX Dev Upscaler、Topaz Image Upscaler。 适用场景:增强低分辨率图像、放大AI生成艺术作品、修复老照片、提升分辨率。 触发词:图像放大、图像放大器、图像增强、提升分辨率、 real esrgan、AI图像放大、超分辨率、图像增强、图像放大处理、 放大图像、更高分辨率、4K图像放大、高清图像放大
通过inference.sh CLI实现AI语音生成、文本转语音(TTS)与语音合成。支持模型:Kokoro TTS、DIA、Chatterbox、Higgs、VibeVoice,可生成自然语音。功能特性:多音色、情感表达、口音模拟、长文本旁白、对话生成。适用场景:配音、有声书、播客、视频旁白、无障碍服务。相关关键词:语音克隆、tts、文本转语音、AI语音、语音生成、语音合成、配音、旁白、语音合成、AI旁白、ElevenLabs替代方案、自然语音、逼真语音、语音AI
通过inference.sh CLI,借助OmniHuman、Fabric、PixVerse创建AI头像和会说话的头部视频。支持模型:OmniHuman 1.5、OmniHuman 1.0、Fabric 1.0、PixVerse Lipsync。功能特性:音频驱动头像、唇形同步视频、会说话的头部生成、虚拟主持人。适用场景:AI主持人、讲解视频、虚拟网红、配音、营销视频。相关关键词:AI头像、会说话的头部、唇形同步、头像视频、虚拟主持人、AI发言人、音频驱动视频、Heygen替代方案、Synthesia替代方案、会说话的头像、唇形同步、视频头像、AI主持人、数字人