获得 1 天 Seedance 2.5 无限使用权及更多内容最低享受 25% 折扣

折扣将在 -- 后过期
虚拟人新

Wan 2.2 S2V

使用 Wan 2.2 语音转视频功能,用语音轨道为静止照片制作动画。输出将跟随您的音频,以自然的语音驱动动作呈现,分辨率可达 480p、580p 或 720p。

尝试 Wan 2.2 S2V

正在使用以下工具生成Wan 2.2 S2V每次生成 4 点

使用 Wan 2.2 S2V 创建

Studio portrait of a 25-year-old Peruvian woman with long dark waves, wearing an off-shoulder rust-orange blouse, ivory backd

Studio portrait of a 25-year-old Peruvian woman with long da

Studio portrait of a friendly woman in her 30s with curly dark hair, warm smile, mustard sweater, soft neutral backdrop, faci

Studio portrait of a friendly woman in her 30s with curly da

功能

  • 照片加音频输入
  • 语音驱动动作
  • 480p / 580p / 720p
  • 音频长度输出

规格

分辨率
480p / 580p / 720p
输入
照片、音频和提示词
音频限制
7.5秒
输出
MP4 视频

输入要求

源照片*
上传图像
用于动画的正前方照片
音频文件*
上传音频
语音音频驱动运动 (最长 7.5 秒)
场景描述*
长文本
分辨率(可选)
选项

价格

起价 4 点额度
~$0.40-$2.30 每次生成

相关模型

常见问题

Wan 2.2 S2V 需要多少成本?

Wan 2.2 S2V 的费用为 每次生成 4 点额度(约 $0.40-$2.30)。您每天可获得 10 个免费额度试用。

我可以商业使用 Wan 2.2 S2V 的输出内容吗?

是的,在 Arteza 上使用 Wan 2.2 S2V 生成的所有内容都附带商业许可证。

Wan 2.2 S2V 输出什么文件格式?

带有唇音同步音频的 MP4 视频文件。