谷歌在欧盟的首席隐私监管机构已展开调查,以确定其在将人们的信息用于训练生成式人工智能这一行为上是否遵守了欧盟的数据保护法。

具体而言,它正在调查这家科技巨头是否需要进行数据保护影响评估(DPIA),以便主动考虑其人工智能技术可能给用于训练模型的个人的权利和自由带来的风险。

生成式人工智能工具因会生成看似合理的虚假内容而声名狼藉。这种趋势,再加上能够按需提供个人信息,给这些工具的制造商带来了很大的法律风险。负责监督谷歌遵守欧盟《通用数据保护条例》(GDPR)情况的爱尔兰数据保护委员会(DPC)有权对任何已确认的违规行为处以高达 Alphabet(谷歌的母公司)全球年营业额 4%的罚款。

谷歌已经开发了几款生成式人工智能工具,包括一整个系列通用的大型语言模型(LLM),并将其命名为双子座(以前是巴德)。它利用该技术为人工智能聊天机器人提供支持,包括增强网络搜索功能。这些面向消费者的人工智能工具的基础在于一个名为PaLM2 的谷歌 LLM,它于去年在其 I/O 开发者大会上推出。

爱尔兰数据保护委员会表示,依据将《通用数据保护条例》转化为国内法的 2018 年爱尔兰《数据保护法》第 110 条,正在对谷歌如何开发这个基础的人工智能模型展开调查。

生成式人工智能模型的训练通常需要大量的数据量,大型语言模型制造商所获取的信息的类型,以及获取这些信息的方式和地点,正因一系列法律问题,包括版权和隐私问题,而受到越来越多的审查。

在后一种情况下,被用作人工智能训练素材且包含欧盟人员个人信息的那些信息,无论其是从公共互联网上抓取的还是直接从用户那里获取的,都需遵守欧盟的数据保护规则。这就是为什么不少大型语言模型已经面临与隐私合规相关的问题——以及一些《通用数据保护条例》的执法——包括OpenAI,GPT(和 ChatGPT)的制造商;以及Meta,其开发了Llama 人工智能模型。

埃隆·马斯克旗下的 X 也招致了《通用数据保护条例》的投诉,以及数据保护委员会对其将人们数据用于人工智能训练这一行为的愤怒——导致了一场法庭诉讼,X 也承诺限制其数据处理,但未被制裁。尽管倘若数据保护委员会认定 X 为训练其人工智能工具 Grok 而处理用户数据的行为违反了规定,X 仍有可能面临《通用数据保护条例》的处罚。

数据保护委员会针对谷歌 GenAI 展开的数据保护影响评估调查是这一领域的最新监管举措。

“此次法定调查所涉及的问题在于,谷歌在处理与其基础人工智能模型 Pathways 语言模型 2(PaLM 2)开发相关的欧盟/欧洲经济区数据主体的个人数据之前,是否依照《通用数据保护条例》(数据保护影响评估)第 35 条履行了其可能承担的进行评估的义务,”数据保护委员会于一份新闻稿中写道。

其指出,数据保护影响评估在处理个人数据可能导致高风险时,对于确保充分考虑并保护个人的基本权利和自由而言,可能具有“至关重要的意义”。

“此项法定调查属于 DPC 更广泛努力的一部分,DPC 与其欧盟/欧洲经济区(EEA)的同行监管机构合作,对在人工智能模型和系统开发中处理欧盟/欧洲经济区数据主体的个人数据进行监管,”DPC 补充说,同时提到了该集团的 GDPR 执法网络为了就如何最好地将隐私法应用于生成式人工智能工具达成某种共识而正在进行的努力。

已联系谷歌,要求其针对 DPC 的询问进行回应。