AI 照片说话生成器
Loading
AI 照片说话
AI 照片说话功能可以用新语音驱动静态人像。把头像、角色或插画脸变成适合消息、讲解和社媒内容的短视频。
上传准备好的音频,或输入脚本并选择可用语言和声音。提交前可预览生成语音,并用正向/反向提示词引导视觉结果。
请选择 JPG、JPEG、PNG 或 WebP 格式、最大 20 MB 的清晰人脸图片。图片宽高需为 300 到 5000 像素,比例为 0.4 到 2.5。语音可为 3 到 120 秒。
它会把静态人像变成视频,让可见人脸与上传音频或文本转语音同步说话。
可以。输入脚本,选择可用语言和声音,并在生成视频前预览语音。
可使用最大 20 MB 的 JPG、JPEG、PNG 或 WebP 图片。图片宽高需在 300 到 5000 像素之间,比例为 0.4 到 2.5。
当前流程支持 3 到 120 秒的语音,超过限制时会在裁剪前提示确认。