最近一段AI女演员的访谈片段在网上传开,正常对话过程里AI突然卡顿停住,没等在场的主持人和嘉宾反应过来,它直接切换成粤语继续往下说,当场把两人都愣住了。

很多人看完第一反应是觉得滑稽,像看了场大型穿帮现场,但仔细琢磨,这个小意外刚好暴露了当前数字人技术的真实成色。

打开网易新闻 查看精彩图片

这个“卡壳后自动切粤语”不是随机乱码,背后是生成式大模型的典型运行逻辑。

当当前语言的生成链路遇到语义断层、算力波动或者语境匹配失效时,模型会自动调取训练数据里置信度更高、语料更完整的片段来补位。

粤语在很多多语言大模型的训练库里,对话类语料的完整度其实很高,当普通话生成卡壳时,模型会误触发高权重的粤语语料库,相当于系统慌了神,先挑自己最熟的频道顶上。

打开网易新闻 查看精彩图片

现在市面上很多AI数字人都主打真人级实时交互,宣传里能接梗、能控场、能应对各种突发提问。

但这类演示大多是在预设脚本里跑,所有提问和回答都在提前喂给模型的范围内,流畅度自然拉满。

一旦放到开放式访谈这种没有台本的场景,对话走向稍微超出预设边界,模型的容错机制就会露出马脚。

这件事也戳中了数字人商业化的一个现实痛点。很多甲方愿意用AI演员,图的是成本低、不会塌房、能连轴转,但默认的前提是能正常完成工作。

可从目前的技术水平看,只要脱离脚本化场景,稳定性就没法打保票。短视频口播、固定流程的直播这类场景还能hold住,访谈、圆桌对话这种需要临场反应的场合,随时可能出各种意料之外的bug。

这次只是切换方言,场面还算好笑,要是在正式商业活动里出现更离谱的输出,损失就远不止尴尬了。

打开网易新闻 查看精彩图片

说到底,这不是什么技术事故,就是现阶段生成式数字人的正常上限。长得像真人,不代表能像真人一样处理所有临场状况。

观众当个乐子看没问题,行业里反倒该借着这个小bug划清边界——哪些场景适合用AI演员,哪些场合还得真人兜底,别为了省成本硬上,最后现场翻车。