数字人(Digital Human)又称虚拟人,是用计算机技术在屏幕上模拟出的类真人形象,能呈现逼真的外观、表情、动作和语音,广泛用于虚拟主播、智能客服、直播带货和品牌代言等场景。

| 类型 | AI 技术 / 虚拟形象 |
| 别名 | 虚拟人、虚拟数字人、数字分身 |
| 核心技术 | 计算机图形学、语音合成、大语言模型、动作捕捉 |
| 驱动方式 | 真人驱动 / AI 驱动 |
| 应用场景 | 虚拟主播、直播带货、智能客服、影视游戏 |
数字人(Digital Human)又称虚拟人、虚拟数字人,是指利用计算机图形学、人工智能等技术在数字世界中模拟出的类似真人的虚拟形象,可以像真人一样说话、做表情、做动作。
数字人的研究涉及人的外观呈现、运动和行为三个层面:外观上要把面部、皮肤、头发等细节做得逼真;运动上要让表情、口型、肢体动作自然流畅;行为上则要让它能理解语言并作出合理回应。早期的数字人主要靠美术人员手工建模和动画师逐帧调整,制作成本很高,多用于影视特效和游戏角色。
随着 AI 技术尤其是大语言模型、语音合成和图像生成的发展,数字人的制作门槛大幅降低。如今只需一段真人视频甚至几张照片,就能克隆出外形和声音都高度相似的数字分身,并由 AI 驱动其实时对话,这让数字人从「贵族技术」变成了大众化的生产力工具。
一个完整的数字人通常由多项技术拼装而成:建模与渲染负责「长得像」,动作捕捉或 AI 驱动负责「动得像」,语音合成(TTS)负责「说得像」,大语言模型则负责「聊得像」。按驱动方式可分为真人驱动型和 AI 驱动型,后者是当前发展的主流方向。
问:数字人和虚拟人是一回事吗?答:日常语境中两者基本通用。细分时,「虚拟人」更强调形象是虚构的(如虚拟偶像),「数字人」范围更广,也包括克隆真人的数字分身。
问:普通人能制作自己的数字人吗?答:可以。目前不少平台支持上传一段真人出镜视频即可克隆形象和声音,再输入文字就能生成口播视频,常用于短视频和直播带货。
问:数字人会带来风险吗?答:会。未经授权克隆他人形象可能侵犯肖像权,逼真的数字人也可能被用于诈骗(参见 AI 换脸 Deepfake),使用时应注意合规并标注 AI 生成内容。

| 类型 | AI 技术 / 虚拟形象 |
| 别名 | 虚拟人、虚拟数字人、数字分身 |
| 核心技术 | 计算机图形学、语音合成、大语言模型、动作捕捉 |
| 驱动方式 | 真人驱动 / AI 驱动 |
| 应用场景 | 虚拟主播、直播带货、智能客服、影视游戏 |
登录 后参与讨论
暂无讨论,来发表第一条评论吧