每天有数百万张照片被传上网络,其中越来越多画面里,摄影师从未按下过快门——因为相机和拍摄地点根本不存在。下面这张山谷照片看起来像度假随拍,实际是神经网络的作品:模型从数十亿个陌生像素里拼出它,再按自己对“午后风景如画的山谷”该长什么样的理解补全细节。

如何分辨虚构画面与真实照片

打开网易新闻 查看精彩图片

最明显的特征是“过于光滑的逼真感”。真实照片总带着随机杂物:角落里的电线、模糊的路人、过曝的天空。神经网络画出的世界,没有任何东西打扰画面成立。细看会发现三处破绽:

  • 纹理重复:草地和树叶局部像同一个印章盖出来的;
  • 几何漂移:栅栏、栏杆、屋顶的线条在该直的地方弯曲;
  • 光线漂亮却不合理:相邻物体的影子朝不同方向落。

单独一个特征不能定罪——奇怪的手指也会出现在真实照片里,耐心等待光线的风景摄影师也能拍出美得不真实的光。真正起作用的是叠加:一个画面里聚集的小异常越多,它是生成图的可能性就越高。

同一个请求,三种不同的森林

结果对措辞有多敏感,从下面这组图能看出来。作者向模型提了同一个要求:森林和神社。变化的只有负面提示词——也就是禁止模型画的内容清单。去掉“绿色的树”,森林变成秋色;禁止“圆形石头”,巨石小路变成整齐的铺路石。

这组对比说明,生成图像不是对现实的记录,而是对文字条件的即时响应。每一条限制都在重塑画面,哪怕场景本身从未改变。

视觉判断正在失效

本文所有风景图都是公有领域作品,由爱好者生成并上传到开放档案。再过一两年,用肉眼分辨这类画面将变得不可能。到那时,“这张照片是不是真的”这个问题,不再靠眼睛回答,而是靠查证来源的习惯——就像我们早已学会用这种方式避开编造的引语和被改写的标题。