Loading...
Loading...
通过inference.sh CLI使用Pruna P-Video-Avatar生成说话头像视频。借助内置TTS将肖像图片转化为逼真的说话视频。速度比竞品快18倍,成本低6倍。模型包括:P-Video-Avatar、P-Image(用于生成肖像)。功能:文本转头像、音频驱动头像、30种音色、10种语言、720p/1080p分辨率、内置TTS、动态背景、全身控制。适用场景:AI主持人、产品演示、讲解视频、虚拟网红、营销、教育、多语言内容、UGC、游戏头像。相关关键词:avatar video、talking head、AI avatar、P-Video-Avatar、Pruna avatar、video avatar、AI presenter、数字人、virtual presenter、唇同步、talking avatar、AI发言人、HeyGen替代方案、Synthesia替代方案、Veed替代方案、Fabric替代方案、OmniHuman替代方案
npx skill4agent add infsh-skills/skills p-video-avatar需要inference.sh CLI()。安装说明belt
belt login
# 从肖像图片+文本脚本生成头像视频
belt app run pruna/p-video-avatar --input '{
"image": "https://portrait.jpg",
"voice_script": "Hello, welcome to our product demo!",
"voice": "Zephyr (Female)"
}'# 1. 使用P-Image生成肖像图片
belt app run pruna/p-image --input '{
"prompt": "professional headshot portrait of a young woman, neutral background, looking at camera, studio lighting, photorealistic",
"aspect_ratio": "9:16"
}'
# 2. 使用第一步生成的图片URL创建头像视频
belt app run pruna/p-video-avatar --input '{
"image": "<image-url-from-step-1>",
"voice_script": "Hi there! Let me walk you through our latest features.",
"voice": "Zephyr (Female)",
"resolution": "720p"
}'belt app run pruna/p-video-avatar --input '{
"image": "https://portrait.jpg",
"voice_script": "Welcome to our product walkthrough. Today I will show you three key features.",
"voice": "Puck (Male)",
"voice_language": "English (US)",
"resolution": "720p"
}'belt app run pruna/p-video-avatar --input '{
"image": "https://portrait.jpg",
"audio": "https://speech.mp3"
}'audiovoice_scriptbelt app run pruna/p-video-avatar --input '{
"image": "https://portrait.jpg",
"voice_script": "This is exciting news for our community!",
"voice": "Aoede (Female)",
"voice_prompt": "Enthusiastic and energetic tone, slightly faster pace",
"video_prompt": "The person is presenting on stage with dramatic lighting",
"resolution": "1080p"
}'# 西班牙语
belt app run pruna/p-video-avatar --input '{
"image": "https://portrait.jpg",
"voice_script": "Bienvenidos a nuestra demostración de producto.",
"voice": "Kore (Female)",
"voice_language": "Spanish"
}'
# 日语
belt app run pruna/p-video-avatar --input '{
"image": "https://portrait.jpg",
"voice_script": "こんにちは、製品デモへようこそ。",
"voice": "Leda (Female)",
"voice_language": "Japanese"
}'belt app run pruna/p-video-avatar --input '{
"image": "https://portrait.jpg",
"voice_script": "Consistent results every time.",
"seed": 42
}'| 参数 | 类型 | 默认值 | 描述 |
|---|---|---|---|
| 文件 | 必填 | 肖像图片(jpg、jpeg、png、webp格式) |
| 字符串 | - | 头像需要说的文本内容 |
| 文件 | - | 音频文件(优先级高于voice_script) |
| 字符串 | "Zephyr (Female)" | 音色选择 |
| 字符串 | "English (US)" | 输出语言 |
| 字符串 | "720p" | 分辨率可选720p或1080p |
| 字符串 | "The person is talking." | 控制头像动作与背景 |
| 字符串 | "Say the following." | 控制语气、语速、情绪 |
| 整数 | 随机值 | 用于生成可复现的结果 |
| 布尔值 | true | 禁用内容过滤 |
| 布尔值 | false | 跳过提示词优化 |
| 分辨率 | 价格 |
|---|---|
| 720p | 每秒钟输出视频0.025美元 |
| 1080p | 每秒钟输出视频0.045美元 |
| 特性 | P-Video-Avatar | Fabric 1.0 | OmniHuman 1.5 | HeyGen Avatar 4 |
|---|---|---|---|---|
| 速度(每生成1秒视频所需时间) | ~1.83秒/秒 | ~34秒/秒(慢18倍) | ~28秒/秒(慢15倍) | ~26秒/秒(慢14倍) |
| 每秒成本 | 0.025美元 | 0.14美元(贵5.6倍) | 0.16美元(贵6.4倍) | 0.075美元(贵3倍) |
| 内置TTS | 是 | 是 | 否 | 是 |
| 动态背景 | 是 | 是 | 否 | 是 |
| 支持1080p | 是 | 否 | 否 | 是 |
video_promptvoice_promptpruna/p-image# 生成肖像图片
belt app run pruna/p-image --input '{"prompt": "professional headshot portrait"}'
# 通用视频生成
belt app run pruna/p-video --input '{"prompt": "cinematic scene"}'
# 图片编辑
belt app run pruna/p-image-edit --input '{"prompt": "change background", "image": "https://photo.jpg"}'# 全平台技能(包含250+应用)
npx skills add inference-sh/skills@infsh-cli
# Pruna视频生成
npx skills add inference-sh/skills@p-video
# Pruna图片生成
npx skills add inference-sh/skills@p-image
# 所有视频生成模型
npx skills add inference-sh/skills@ai-video-generation
# 图片生成(用于创建肖像)
npx skills add inference-sh/skills@ai-image-generationbelt app list --namespace pruna