1. 上传一张人像
选择不超过 10MB 的 JPG、PNG 或 WebP 文件。服务端会校验文件是否可读,并统一转换为 JPEG。为了获得更好的结果,请使用脸部清晰可见的人像。
必要存储用于登录和偏好设置。经你允许后,分析服务会帮助我们衡量页面与转化表现;广告存储始终关闭。
Loading…
产品流程
TalkingPhoto 接收两项由你提供的素材——人像照片和语音音频——并提交给 AI 说话人像模型。本页说明真实生产流程及其边界。
选择不超过 10MB 的 JPG、PNG 或 WebP 文件。服务端会校验文件是否可读,并统一转换为 JPEG。为了获得更好的结果,请使用脸部清晰可见的人像。
提供不超过 10MB 的 MP3、WAV 或 M4A 录音。只使用你录制的或已获授权的音频。
服务端会预占 1 个额度,并将任务异步发送给 AI 供应商。状态页会显示排队、处理、完成或失败。
供应商返回视频后,TalkingPhoto 会将其存入对象存储,并仅向登录的所有者开放。
当前上传校验会检查文件完整性和图片可读性,不承诺在生成前自动完成人脸检测。为了获得更好的结果,建议从以下条件开始:
不要冒充他人、制作欺骗性媒体,也不要在没有必要许可的情况下上传他人的照片或声音。