Wan 2.2 S2V
Анімуйте нерухому фотографію зі звуковою доріжкою за допомогою Wan 2.2 Speech-to-Video. Вихід відповідає вашому аудіо з природними, керованими мовою рухами в 480p, 580p або 720p.
Спробуйте Wan 2.2 S2V
Створено за допомогою Wan 2.2 S2V
Studio portrait of a 25-year-old Peruvian woman with long da
Studio portrait of a friendly woman in her 30s with curly da
Можливості
- Введення фотографії та аудіо
- Рухи, керовані мовою
- 480p / 580p / 720p
- Вихід за тривалістю аудіо
Специфікації
- Розширення
- 480p / 580p / 720p
- Вхідні дані
- Фотографія + Аудіо + Підказка
- Обмеження аудіо
- 7,5s
- Вихід
- MP4 Відео
Вимоги до вводу
Пов'язані моделі
OmniHuman v1.5
Перетворення фотографії та звуку на аватара, що говорить
Kling Avatar v2
Універсальна синхронізація губ для будь-якого персонажа
SadTalker
Бюджетний аватар з фотографії та аудіо
Sync-3 Lipsync
Дублювання відео з синхронізацією губ 4K
Hunyuan Avatar
Мовлення та спів (Переведено в архів)
Fabric 1.0
Говорячий аватар з фото та аудіо
Infini Talk
Аудіо-керований говорячий аватар
Часто задавані питання
Скільки коштує Wan 2.2 S2V?
Wan 2.2 S2V коштує 4 кредитів за генерацію (~$0.40-$2.30). Ви отримуєте 10 безкоштовних кредитів щодня, щоб спробувати його.
Чи можу я використовувати результати Wan 2.2 S2V в комерційних цілях?
Так, весь контент, згенерований з використанням Wan 2.2 S2V на Arteza, постачається з комерційною ліцензією.
Який формат файлу видає Wan 2.2 S2V?
Відеофайли MP4 з синхронізованим аудіо.