AI 数字人:会说话的虚拟分身
数字人,是用 AI 生成的"虚拟真人"——有脸、有嘴型、能说话、能播报。从新闻主播到电商客服,到处能见着。它本质是"图像/视频生成 + 语音 + 口型同步"的组合。
常见形态
① 播报型:固定形象读稿,适合资讯、培训;② 对话型:能实时聊,做客服/导览;③ 分身型:克隆真人形象和声音,替你出镜拍视频。
在哪用得着
电商 24 小时直播、企业培训视频、短视频矩阵、无障碍播报。一个人+一个数字人,能顶过去一个小团队的内容产出。
门槛
现成平台(如 HeyGen)网页就能做,不用技术;要更可控、更低成本可本地跑开源方案,但要显卡和调参。
数字人到底分几种
别把数字人想成一个东西。粗略分三档:第一档是"照片/视频生成型",你上传一张正脸照或一段真人视频,AI 直接驱动这张脸说话,最便宜最快,适合做口播短片;第二档是"真人驱动型(中之人)",背后有个真人戴设备实时操控表情动作,直播里常见;第三档是"3D 建模型",从零建一个虚拟形象,能做的动作最丰富,但成本和周期也最高。
挑哪种看用途。做知识口播、企业宣传,照片生成型就够了,半天出片;做虚拟偶像、需要复杂肢体语言,得上 3D;做 7×24 直播带货,真人驱动型能随时接话。很多人一上来就奔着 3D 去,结果钱花了、形象还僵硬,其实大部分生意用第一档就能解决。
做一次数字人要花多少
成本跨度极大。用 HeyGen、即创这类 SaaS,按生成时长订阅,做几条短视频每月几十到几百块;要"定制一个专属形象",平台通常收一次性建模费加年费,从几千到几万不等;真搞影视级 3D 数字人,那是按项目报价,几十万起步。新手建议先从订阅制试水,确认真有需求再谈定制。
还有一个隐性成本是"维护"。数字人形象一旦定下,换衣服、换场景、换口音往往要重新生成或付费,合同条款要看清。别被"一次生成永久用"的宣传忽悠,真到了要批量换素材的时候,发现每张图都单独计费,预算就崩了。
