仅需提供一张照片,即可快速生成 AI 精品形象,无需额外拍摄视频素材,彻底摆脱真人模特、专属拍摄场景的限制,有效降低拍摄成本和时间投入。
支持播报服务及交互服务,并具备灵活的动作编辑功能。
可在文本中插入对应动作标签,让形象在播报、交互过程中同步做出指定动作,提升视频自然观感。目前内置 20 款基础动作,详情可查看下方动作清单。
一、照片要求
照片类型:真人实拍照片 或 AI 生成的高仿真人像照片均可。
画面构图:全身或半身(腰部以上)的正面站立姿态。
画质比例:竖屏9:16,分辨率 ≥ 1080×1920 像素。
背景要求:如需换背景,需要提供绿底背景。
身体姿态建议:
1. 正面朝向镜头,双眼平视。
2. 身体站直,双肩自然放松、水平。
3. 采用 “全身站姿” 或 “半身站姿(腰部以上)”。
4. 手臂自然下垂置于身体两侧,或双手在身前自然交叉/搭放。
照片示例:

二、动作清单
20个标准动作清单 | ||||||
通用播报 适用于任何播报场景 | 姿势参考 | ![]() | ![]() | ![]() | - | - |
| 动作标签中文 | 双手指向前方1 | 右手指向前方 | 左手指向前方 | - | - |
| 动作标签英文 | 2hands_forward1 | right_forward | left_forward | - | - |
| | | | | | |
入退场 适用于进退场的场景 | 姿势参考 | ![]() | ![]() | ![]() | - | - |
| 动作标签中文 | 欢迎 | 挥手 | 弯腰鞠躬 | - | - |
| 动作标签英文 | welcome | waving_hand | bow | - | - |
| | | | | | |
指引播报 适用于进行信息播报等有引导的场景 | 姿势参考 | ![]() | ![]() | ![]() | ![]() | - |
| 动作标签中文 | 双手指向听者 | 左手指向左侧1 | 右手指向右侧1 | 左手指向左上1 | - |
| 动作标签英文 | point_forward2 | left_side1 | right_side1 | left_up1 | - |
| 姿势参考 | ![]() | ![]() | ![]() | ![]() | ![]() |
| 动作标签中文 | 左手点按前方 | 数字1 | 数字2 | 数字3 | 数字5 |
| 动作标签英文 | left_point | right_num1 | right_num2 | right_num3 | right_num5 |
| | | | | | |
情绪反应 适用于需要有明显情绪反应的场景 | 姿势参考 | ![]() | ![]() | ![]() | ![]() | ![]() |
| 动作标签中文 | OK | 单手比心 | 恭喜 | 加油 | 点赞 |
| 动作标签英文 | right_ok | right_show_love | congratulation | support | compliment_state |
三、交付流程图

四、交付流程
流程 | 具体内容 | 干系人 | 预估周期(天&工作日) |
用户下单 | 下单购买 | 用户 | 由用户决定 |
用户形象选择 | 用户自行提供一张人物照片,包含服装&发型&姿态等 | 用户 | 由用户决定 |
确认照片是否符合要求 | 确定照片是否符合要求 | 腾讯 | 1 |
生成动作数据 | 生成20个动作视频 | 腾讯 | 2 |
动作效果确认 | 确认动作视频的效果 | 用户 | 由用户决定 |
模型训练 | 基于生成的动作视频训练 AI 精品数字人 | 腾讯 | 5 |
整体效果确认 | 确认最终效果 | 用户&腾讯 | 由用户决定 |



















