Wan 2.2 S2V
یک عکس ثابت را با یک پیست صوتی متحرک کنید با استفاده از Wan 2.2 Speech-to-Video. خروجی از صوت شما پیروی می کند با حرکت طبیعی و تحت کنترل گفتار در 480p، 580p یا 720p.
امتحان Wan 2.2 S2V
ایجاد شده با Wan 2.2 S2V
Studio portrait of a 25-year-old Peruvian woman with long da
Studio portrait of a friendly woman in her 30s with curly da
ویژگیها
- ورودی عکس و صوت
- حرکت تحت کنترل گفتار
- 480p / 580p / 720p
- خروجی به طول صوت
مشخصات
- وضوح
- 480p / 580p / 720p
- ورودی
- عکس + صوت + Prompt
- محدودیت صدا
- 7.5s
- خروجی
- ویدیو MP4
الزامات ورودی
مدلهای مرتبط
OmniHuman v1.5
عکس + صدا به آواتار صحبت کننده
Kling Avatar v2
هماهنگی لب برای هر شخصیتی
SadTalker
آواتار مقرون به صرفه از عکس و صوت
Sync-3 Lipsync
دوبله ویدیو با هماهنگی لب 4K
Hunyuan Avatar
صحبت کننده و خواننده (منسوخ شده)
Fabric 1.0
آواتار صحبت کننده از عکس و صوت
Infini Talk
آواتار صحبت کننده کنترل شده توسط صوت
سوالات متداول
هزینه Wan 2.2 S2V چقدر است؟
مدل Wan 2.2 S2V هزینه ۴ اعتبار در هر تولید ($~$0.40-$2.30) دارد. هر روز 10 اعتبار رایگان برای امتحان آن دریافت میکنید.
آیا میتوانم از خروجیهای Wan 2.2 S2V به صورت تجاری استفاده کنم؟
بله، تمام محتوایی که با Wan 2.2 S2V در Arteza تولید میشود دارای مجوز تجاری است.
Wan 2.2 S2V چه فرمت فایلی خروجی میدهد؟
فایلهای ویدیویی MP4 با صوت همزمان با لبها.