Loading...
Loading...
共找到 51 个 Skills
通过inference.sh CLI,使用BiRefNet移除图片背景。模型:BiRefNet(高精度背景移除)。适用场景:商品照片、人像、电商、透明PNG、照片编辑。触发词:移除背景、背景去除、去背景、透明背景、抠图、背景移除工具、rembg、商品照片编辑、抠图、透明PNG、背景去除、照片抠图
通过inference.sh CLI使用Black Forest Labs的FLUX模型生成图片。支持的模型:FLUX Dev LoRA、具备自定义风格适配的FLUX.2 Klein LoRA。功能包括:文本生成图片、图片生成图片、LoRA微调、自定义风格。触发关键词:flux、flux.2、flux dev、flux schnell、flux pro、black forest labs、flux image、flux ai、flux model、flux lora
通过inference.sh CLI,借助Diffrythm、Tencent Song Generation生成AI音乐与歌曲。 模型:Diffrythm(快速生成歌曲)、Tencent Song Generation(带人声的完整歌曲)。 功能:文本转音乐、歌曲生成、纯音乐、歌词转歌曲、原声配乐创作。 适用场景:背景音乐、社交媒体内容、游戏原声、播客、免版税音乐。 相关触发词:音乐生成、AI音乐、生成歌曲、AI作曲、文本转音乐、歌曲生成器、用AI创作音乐、Suno替代工具、Udio替代工具、AI歌曲、AI原声配乐、生成原声配乐、AI广告短曲、音乐AI、节拍生成器
构建结合多个模型与服务的自动化AI工作流。支持的模式包括:批量处理、定时任务、事件驱动型流水线、Agent循环。使用工具:inference.sh CLI、bash脚本、Python SDK、Webhook集成。适用场景:内容自动化、数据处理、监控、定时生成。触发场景:AI自动化、工作流自动化、批量处理、AI流水线、自动化内容生成、定时AI任务、AI Cron作业、AI批量任务、自动化生成、AI工作流、规模化内容生产、自动化脚本、AI编排
通过inference.sh CLI运行150+款AI应用——涵盖图像生成、视频创作、大语言模型(LLMs)、搜索、3D建模、Twitter自动化等功能。 模型支持:FLUX、Veo、Gemini、Grok、Claude、Seedance、OmniHuman、Tavily、Exa、OpenRouter等众多模型。 适用场景:运行AI应用、生成图像/视频、调用LLMs、网页搜索或Twitter自动化操作。 触发关键词:inference.sh、infsh、ai model、run ai、serverless ai、ai api、flux、veo、claude api、image generation、video generation、openrouter、tavily、exa search、twitter api、grok
通过inference.sh CLI使用阿里巴巴HappyHorse 1.0模型生成和编辑视频。包含模型:HappyHorse T2V、I2V、R2V、视频编辑模型。功能:文本转视频、图片转视频、参考图转视频、自然语言视频编辑、角色保留、支持720P/1080P分辨率、最长15秒时长。适用场景:真实物理效果视频、视频编辑、角色一致性内容、产品演示、社交媒体。触发关键词:happyhorse、happy horse、alibaba video、happyhorse 1.0、dashscope video、alibaba happyhorse、video editing ai、ai video editor
通过inference.sh CLI实现AI语音生成、文本转语音(text-to-speech)及语音合成。支持模型包括:Inworld TTS-2(支持100+种语言,可调控情绪/非语言表达)、Inworld TTS 1.5(超低延迟)、ElevenLabs(22+种优质语音,32种语言),以及Kokoro TTS、DIA、Chatterbox、Higgs、VibeVoice,均可生成自然语音。功能特性:多语音选择、情绪调控、口音模拟、长篇旁白、对话生成、语音转换、交付模式控制、角色语音。适用场景:配音、有声书、播客、视频旁白、无障碍服务、游戏NPC语音、虚拟形象音频、UGC内容。相关触发词:语音克隆、tts、text to speech、ai voice、语音生成、语音合成、配音、旁白、语音合成、ai narrator、elevenlabs、eleven labs、自然语音、逼真语音、voice ai、变声器、inworld、inworld tts、角色语音、npc voice
ElevenLabs 语音隔离工具 - 通过 inference.sh CLI 去除音频中的背景噪音并分离人声。功能:噪音消除、人声提取、音频净化、背景音移除。适用场景:播客音频净化、采访音频处理、音乐人声提取、嘈杂录音处理、音频修复。触发词:语音隔离工具、噪音消除、背景音移除、分离人声、净化音频、去除背景噪音、音频净化、人声提取、ElevenLabs隔离工具、ElevenLabs噪音处理、人声分离、降噪、音频修复、语音分离
通过inference.sh CLI借助ElevenLabs从文本描述生成AI音效。核心功能:文本转音效、自定义时长、免版税音频。适用场景:视频制作、游戏音频、播客、电影、演示文稿、社交媒体。相关关键词:sound effects、sfx、sound generation、AI音效、音效生成、foley、音频特效、声音设计、文本转声音、ElevenLabs音效、ElevenLabs SFX、环境音效、电影音效、游戏音效
ElevenLabs 语音变声器 - 通过 inference.sh CLI 将任意语音转换为其他语音,同时保留语音内容与情感。支持模型:eleven_multilingual_sts_v2(支持70+种语言)、eleven_english_sts_v2。功能:语音转语音、语音变换、口音更改、语音伪装。适用场景:内容创作、配音、隐私保护、配音制作、角色语音。关键词:语音变声器、语音转语音、语音变换、更改语音、语音互换、语音转换、语音伪装、ElevenLabs语音变声器、elevenlabs sts、变换语音、AI语音变声器、语音修改器
通过inference.sh CLI使用阿里巴巴Qwen-Image-2.0模型生成和编辑图片。可用模型:Qwen-Image-2.0(快速版)、Qwen-Image-2.0-Pro(专业文字渲染版)。功能支持:文本生成图片、多图编辑、复杂文字渲染。触发关键词:qwen image、qwen-image、alibaba image、dashscope image、qwen image 2、qwen image pro
通过inference.sh CLI使用Tavily和Exa进行网页搜索与内容提取。应用包括:Tavily Search、Tavily Extract、Exa Search、Exa Answer、Exa Extract。功能:AI驱动搜索、内容提取、直接答疑、调研。适用场景:调研、RAG流水线、事实核查、内容聚合、Agent。相关触发词:网页搜索、tavily、exa、搜索API、内容提取、调研、互联网搜索、AI搜索、搜索助手、网页抓取、rag、Perplexity替代方案