Loading...
Loading...
共找到 112 个 Skills
借助ElevenLabs生成高质量旁白音频,包含用于视频同步的逐词时间戳。适用场景:制作演示旁白、视频配音、播客开场或任何文本转语音(TTS)需求。关键词:旁白、TTS、文本转语音、ElevenLabs、解说、音频、时间戳。
文本转语音工具 - 支持脚本解析、情绪标记和后处理,基于 Edge TTS
使用HeyGen的Starfish TTS模型将文本转换为语音音频。适用于以下场景:(1) 从文本生成独立的语音音频文件;(2) 可选择语音、调节语速和音调的文本转语音转换;(3) 为旁白、解说或播客创建音频;(4) 调用HeyGen的/v1/audio接口;(5) 按语言或性别列出可用的TTS语音。
借助EachLabs AI模型实现文本转语音、语音转文本、声音转换及音频处理功能。支持ElevenLabs TTS、带说话人分离的Whisper转写以及RVC声音转换。适用于用户需要文本转语音、语音转写或声音转换的场景。
VoxFlow AI语音工具包——拥有200+种音色的文本转语音合成、AI播客生成、有声故事创作以及语音搜索功能。当用户需要任何语音/音频合成相关任务时,可使用该技能。
[QianWen] 借助Qwen TTS模型将文本转换为语音。触发场景:用户需要将文本转语音、制作旁白、生成音频解说、朗读文本、构建TTS应用,提及语音合成/语音生成/文本转音频输出,或明确通过名称调用此技能(例如:use qianwen-audio-tts)。不触发场景:用户需要语音识别/ASR、无需音频的文本生成、非Qwen相关的音频任务。
MiniMax TTS API - 文本转语音、声音克隆、声音设计
基于sherpa-onnx的本地文本转语音(离线、无需云端)
使用此技能进行AI文本转语音生成。触发词包括:“生成语音”、“创建音频”、“文本转语音”、“TTS”、“大声朗读这段内容”、“生成旁白”、“创建配音”、“合成语音”、“播客音频”、“对话音频”、“多说话人”、“有声书”。支持Google Gemini TTS、ElevenLabs和OpenAI TTS。
由CellCog驱动的AI音频生成服务,支持文本转语音、语音合成、旁白配音、播客音频、内容旁白、音乐生成、背景音乐、音效设计,助力实现专业级AI音频创作。
播放音频文件、使用文本转语音功能以及录制通话。适用于构建IVR系统、播放公告或录制对话场景。本技能提供JavaScript SDK示例。
在Ubuntu上使用带回退方案的Kokoro TTS实现本地文本转语音。当用户要求朗读文本、测试音频输出、切换Kokoro语音或调试TTS播放问题时使用。触发关键词包括“朗读这段内容”、“大声读出来”、“说话”、“TTS”、“语音测试”。