打开网易新闻 查看精彩图片

欧洲对大型科技公司的监管力度正持续加强。欧盟委员会计划于下月宣布针对谷歌的新监管规定,相关规则可能迫使谷歌欧盟竞争对手开放更多权限。对此,谷歌表达了自己的顾虑,并将其定性为对用户隐私的真实担忧,而非垄断惯性的体现。

谷歌安全工程副总裁希瑟·阿德金斯向《连线》杂志表示,欧盟的提案可能引发严重的安全与隐私问题。相关变化主要涵盖两个方面:一是监管机构希望打破Gemini作为Android唯一集成AI服务的地位,允许用户接入其他AI模型,并赋予这些模型类似Gemini的系统级访问权限;二是欧盟希望谷歌将匿名化的搜索数据分享给其他公司。

阿德金斯表示:"如果按照目前描述的方式实施,我认为在短期内,欧盟地区的Android设备上将出现欺诈行为的显著增加。"她指出,这些情况可能在相关变更落地后数周内发生。

Gemini在Android设备上享有特殊权限,可访问用户文件、屏幕内容,并支持增强型语音交互。阿德金斯虽未深入阐述细节,但言下之意是,不法分子可能借助新开放的权限安装恶意AI服务,从而窃取数据并操控用户体验。

谷歌对匿名数据共享问题有更具体的担忧。根据欧盟委员会提案草案,谷歌须向竞争对手提供与其内部使用相近的匿名搜索数据,内容可能涵盖搜索词、排名及点击率等信息。这些数据是谷歌搜索产品的核心资产,此前从未以如此精细的粒度对外提供。

"匿名化本身是一件非常困难的事,必须有合适的技术专家参与,才能制定出真正可行的解决方案。"阿德金斯告诉《连线》杂志。

业界早已知晓,从所谓的匿名数据中还原个人身份在技术上完全可行。谷歌还指出,功能强大的AI模型的广泛普及,使得对大规模数据集的去匿名化变得比以往任何时候都更加容易。据报道,谷歌内部安全团队已能通过"链接攻击"等手段,在短短两小时内将匿名搜索数据与具体用户关联起来。

谷歌方面向《连线》表示,将这些数据依法交给欧洲规模较小的企业,将使这些企业成为攻击目标。谷歌对自身数据安全能力抱有信心,但对欧洲一些规模较小的初创公司能否妥善保护数据,则持保留态度。

强制要求谷歌与竞争对手共享数据和系统访问权限,确实可能带来一定的安全风险;但同样不可否认的是,谷歌在维护自身市场地位方面有着切实的利益动机。两者可以同时成立,但孰轻孰重,正是欧盟委员会必须面对的核心问题。

欧盟此次行动依据的是《数字市场法》(DMA)。该法已将谷歌、Meta、亚马逊等科技巨头认定为须接受额外监管的"守门人"。谷歌公开反对DMA,并呼吁对其进行修订。考虑到谷歌在多个科技领域占据主导地位——包括逾90%的网页搜索市场份额——该公司显然没有支持加强监管的动力。

对于数据匿名化,谷歌本身拥有丰富的技术手段,例如将共享某一特征(如邮政编码)的群体数据合并处理,或将不同类型的搜索词混合以遮蔽敏感话题的关联,以及在数据中加入随机噪声以进一步隐匿身份。这些技术被应用于谷歌旗下的搜索、位置、广告、应用使用等各类服务,并在其隐私条款中有所说明。谷歌也一再保证,这些数据经过充分匿名处理,即便与第三方共享也不存在隐私问题。然而,一旦欧盟要求谷歌将匿名搜索数据提供给竞争对手,这一问题便被描述成难以接受的隐私风险。这不禁令人质疑:无论这些匿名数据由谁持有,其安全性本身或许都值得审视。

尽管如此,此次监管行动确实涉及一些真实存在的隐私风险。谷歌的核心论点在于,数据的精细程度使其极易遭到去匿名化处理。一旦数据被窃,其中至少部分内容很可能被还原为可识别的个人信息。

欧盟委员会需要在谷歌的商业利益与削弱其垄断地位的监管目标之间寻求平衡。目前,一切尚无定论。公众意见征询期已于5月1日结束,委员会正在研究如何落实新规,并预计于7月27日作出最终裁定。该裁定将作为DMA授权下的法律约束措施,对谷歌正式生效。因此,AI访问权限与数据匿名化的具体要求目前仍存在变数。

Q&A

Q1:欧盟《数字市场法》对谷歌有哪些具体要求?

A:根据欧盟委员会的提案草案,谷歌须在两方面作出改变:一是打破Gemini作为Android唯一集成AI服务的地位,允许用户接入其他AI模型并赋予其系统级权限;二是向竞争对手提供匿名化搜索数据,内容涵盖搜索词、排名及点击率等。这些要求旨在削弱谷歌的市场垄断地位,相关最终裁定预计于2025年7月27日公布,并将对谷歌具有法律约束力。

Q2:谷歌为什么认为匿名搜索数据共享存在安全风险?

A:谷歌认为,数据的精细粒度使其极易遭到去匿名化攻击。据报道,谷歌内部安全团队已能通过"链接攻击"在两小时内将匿名搜索数据与具体用户关联起来。此外,随着大语言模型的广泛普及,对大规模数据集进行去匿名化变得更加容易。谷歌还担忧,欧洲规模较小的企业在数据安全防护能力上难以与谷歌相当,一旦数据被窃,将面临更大的隐私泄露风险。

Q3:谷歌通常用哪些方法保护匿名数据?

A:谷歌主要采用三种匿名化技术:一是将共享某一特征(如邮政编码)的用户群体数据合并,以隐藏个人身份;二是将不同类型的搜索词混合,遮蔽与敏感话题的关联;三是在数据中加入随机噪声,进一步模糊个体特征。这些技术被应用于搜索、位置、广告及应用使用等多类服务,并在谷歌的隐私条款中有所说明。