图片数字人

上传图片

点击或拖拽文件到此区域上传
格式: jpg/png/webp, 大小: 不超过 20M 尺寸: 宽度和高度均在300-5000像素之间

(若不选择背景,则无法使用背景抠图)

上传图片

点击或拖拽文件到此区域上传
格式: jpg/png, 大小: 不超过 20M

照片数字人

用照片创建 AI 数字人

把一张正脸人像变成可复用的说话数字人。不需要相机、脚本或棚拍录制,这张照片会变成你每次创建 lip-sync 视频时可选择的数字人。

  • 一张正脸
  • JPG、PNG 或 WebP,最大 20 MB
  • 约 1 分钟训练完成

图片生成形象操作流程

  1. 上传一张您自己的照片。AI会驱动该照片运动和说话。确保您自己看起来美观清晰。
  2. 上传后,点击"快速创建"开始AI训练。
  3. 等待1分钟,然后您的AI 克隆可以从"视频创建"-"我的形象"中选择使用。
  4. 禁止上传公众人物照片,系统会返回失败

价格:30 个金币

原始素材要求

  • 图片中人物为正脸(角度能同时看到两侧耳朵)
  • 确保图片中只有一张人脸, 不支持画面中包含多张人脸
  • 人脸不宜过大或过小,确保整张人脸都在屏幕区域内,人脸不要出屏幕, 建议人脸宽度占整体画面宽度的十分之一至三分之一
  • 确保面部特征未被遮挡,使五官和面部轮廓清晰可见
示例
五官清晰
五官清晰
侧面
侧面
有遮挡
有遮挡
过于模糊
过于模糊
多个人脸
多个人脸
占比过大
占比过大

原始背景要求

  • 如果您需要移除上传图片或视频中的背景,请上传对应背景的图片。背景图片必须和原始图片或视频的尺寸和分辨率一致。背景图片不是您将来替换的图片,而是您原始图片或视频中的背景部分。例如,如果你的视频是你自己在某个房间中拍摄的口播视频,则背景图片必须是这个房间从同一个角度拍摄的照片。
  • 如果您的原始图片或视频只有纯色背景,例如绿幕,您也可以从色盘中选取和您视频背景颜色一样的颜色。
  • 如果您不需要做背景移除,请忽略上传背景图。
示例
原始素材
原始素材
原始背景
原始背景
抠图效果
抠图效果

照片数字人还是视频数字人?

照片数字人是最快路径:一张静态人像、约 1 分钟训练,就能让数字人朗读任意脚本。视频数字人则从说话表演中学习,可捕捉自然动作并继续训练以获得更接近的口型。如果已有可用视频,就用视频训练;如果只有头像照,就从这里开始。

授权和公众人物

照片数字人会复现真实人物的形象,因此只上传你拥有或被授权处理的人像,并取得本人同意。公众人物照片不被接受,训练任务会失败而不是生成数字人。

照片生成 AI 数字人常见问题

  • 如何用照片创建 AI 数字人?

    上传一张正脸人像,启动 Instant Avatar 训练,大约 1 分钟后在创建 lip-sync 视频时从“我的数字人”选择它。

  • 需要几张照片?什么照片效果最好?

    一张照片即可。建议使用正面人像,双耳可见,画面中只有一张脸,没有墨镜等遮挡,人脸宽度约占图片宽度的十分之一到三分之一。

  • 支持哪些图片格式和大小?

    上传器支持 JPG、PNG 和 WebP,最大 20 MB。更高分辨率的人像能提供更多面部细节。

  • 照片数字人训练多久、花费多少?

    照片数字人训练大约 1 分钟,费用为 30 credits。视频数字人需要从说话表演中学习,因此耗时更长。

  • 应该用照片还是视频创建数字人?

    只有静态人像并希望快速开始时选择照片模式;能提供说话视频并希望获得更接近的口型时选择视频模式。

  • 可以用别人的照片创建数字人吗?

    必须获得对方许可。请只上传你拥有或被授权处理的照片,并取得用于创建数字人及对应用途的同意。公众人物照片会被拒绝并返回失败。