Loading...
Loading...
ElevenLabs文本转语音服务,拥有22+种优质语音、多语言支持,可通过inference.sh CLI进行语音调优。模型包括:eleven_multilingual_v2(最高音质)、eleven_turbo_v2_5(低延迟)、eleven_flash_v2_5(超快速)。功能:文本转语音、语音选择、稳定性/风格控制、支持32种语言。适用场景:旁白配音、有声书、视频解说、播客、无障碍服务、交互式语音应答(IVR)。触发词:elevenlabs、eleven labs、elevenlabs tts、premium tts、professional voice、ai voice、high quality tts、multilingual tts、eleven labs voice、voice generation、natural speech、realistic voice、voice over、speech synthesis
npx skill4agent add inferen-sh/skills elevenlabs-tts
需要inference.sh CLI()。安装说明infsh
infsh login
# 使用ElevenLabs生成语音
infsh app run elevenlabs/tts --input '{"text": "Hello, welcome to our product demo.", "voice": "aria"}'| 模型 | ID | 最适用场景 | 延迟 |
|---|---|---|---|
| 多语言v2 | | 最高音质,支持32种语言 | ~250ms |
| Turbo v2.5 | | 速度与音质平衡 | ~150ms |
| Flash v2.5 | | 超低延迟 | ~75ms |
| 语音 | 风格 |
|---|---|
| 美式,口语化 |
| 英式,自信沉稳 |
| 美式,温暖亲和 |
| 美式,富有表现力 |
| 美式,专业正式 |
| 英式,轻柔温和 |
| 美式,友好亲切 |
| 语音 | 风格 |
|---|---|
| 英式,权威正式 |
| 美式,低沉浑厚 |
| 美式,成熟稳重 |
| 美式,口语化 |
| 大西洋两岸口音,富有张力 |
| 澳式,自然随性 |
| 美式,休闲轻松 |
| 英式,有号召力 |
| 美式,友好亲切 |
| 美式,年轻活力 |
| 美式,清晰流畅 |
| 美式,温暖亲和 |
| 美式,自信沉稳 |
| 美式,权威正式 |
| 美式,明亮轻快 |
infsh app run elevenlabs/tts --input '{"text": "Welcome to our quarterly earnings presentation.", "voice": "george"}'# 最高音质
infsh app run elevenlabs/tts --input '{
"text": "This is our premium multilingual model with the best quality.",
"voice": "aria",
"model": "eleven_multilingual_v2"
}'
# 适用于实时应用的超快速模型
infsh app run elevenlabs/tts --input '{
"text": "Flash model for low-latency applications.",
"voice": "brian",
"model": "eleven_flash_v2_5"
}'infsh app run elevenlabs/tts --input '{
"text": "Fine-tune the voice characteristics for your use case.",
"voice": "bella",
"stability": 0.3,
"similarity_boost": 0.9,
"style": 0.4
}'| 参数 | 范围 | 效果 |
|---|---|---|
| 0-1 | 值越高,语音越稳定;值越低,表现力越强 |
| 0-1 | 值越高,越贴近原始语音特征 |
| 0-1 | 值越高,风格夸张度越强 |
| true/false | 提升说话人清晰度 |
# 高品质MP3
infsh app run elevenlabs/tts --input '{
"text": "High quality audio output.",
"voice": "daniel",
"output_format": "mp3_44100_192"
}'| 格式 | 说明 |
|---|---|
| MP3格式,44.1kHz,128kbps(默认) |
| MP3格式,44.1kHz,192kbps |
| 原始PCM格式,16kHz |
| 原始PCM格式,22.05kHz |
| 原始PCM格式,24kHz |
| 原始PCM格式,44.1kHz |
# 西班牙语
infsh app run elevenlabs/tts --input '{
"text": "Hola, bienvenidos a nuestra presentación.",
"voice": "aria",
"model": "eleven_multilingual_v2"
}'
# 法语
infsh app run elevenlabs/tts --input '{
"text": "Bonjour, bienvenue à notre démonstration.",
"voice": "alice",
"model": "eleven_multilingual_v2"
}'# 1. 生成旁白配音
infsh app run elevenlabs/tts --input '{
"text": "Introducing the future of AI-powered content creation.",
"voice": "george"
}' > voiceover.json
# 2. 创建虚拟人视频
infsh app run bytedance/omnihuman-1-5 --input '{
"image_url": "https://portrait.jpg",
"audio_url": "<audio-url-from-step-1>"
}'# ElevenLabs多角色对话
npx skills add inference-sh/skills@elevenlabs-dialogue
# ElevenLabs语音变声器
npx skills add inference-sh/skills@elevenlabs-voice-changer
# ElevenLabs音效生成
npx skills add inference-sh/skills@elevenlabs-sound-effects
# 所有TTS模型(Kokoro、DIA、Chatterbox等)
npx skills add inference-sh/skills@text-to-speech
# 全平台技能(包含150+应用)
npx skills add inference-sh/skills@infsh-cliinfsh app list --category audio