本周的科技圈,一则关于亚马逊的报道引发了广泛关注:这家电商巨头被曝购买并销毁大量珍稀书籍,用于训练人工智能模型。据相关报道,一批被追踪的珍稀书籍货物,最终抵达了亚马逊的AI训练设施。
珍稀书籍的“终点站”
报道显示,有人对一批珍稀书籍的运输过程进行了追踪,结果发现这些书籍的最终目的地是亚马逊的AI训练设施。这一发现将亚马逊的AI训练数据来源问题推向了台前。此前,关于科技公司如何使用受版权保护的材料训练AI模型,一直存在争议,而此次事件则提供了一个具体的案例。
报道并未透露这批书籍的具体数量、价值以及亚马逊购买这些书籍的具体渠道。但“购买并销毁”这一行为本身,已经足以引发出版行业和作者群体的担忧。对于依赖版税收入的作者和出版商而言,如果大型科技公司通过购买实体书来获取训练数据,而非通过授权协议,可能会对现有的版权商业模式造成冲击。
AI训练数据的灰色地带
这并非科技公司首次因AI训练数据来源而受到质疑。此前,已有多个案例显示,AI公司会从互联网上抓取大量文本数据,其中可能包含受版权保护的内容。而亚马逊此次被曝出的行为,则展示了另一种可能:通过购买实体书籍,将其数字化后用于训练,而这一过程可能绕过了与版权所有者的直接授权协商。
对于亚马逊而言,这一做法或许是为了获取高质量、结构化的文本数据,以提升其AI模型的性能。珍稀书籍往往包含独特的历史、文化或专业知识,对于训练特定领域的AI模型可能具有较高价值。然而,这种做法在法律和伦理层面都面临挑战。目前,关于AI训练数据合理使用的法律界定仍在完善中,各国监管机构也在密切关注相关案例。
AI应用的另类案例
在本周的讨论中,还涉及了其他几个关于AI应用的案例。其中一个案例是,一名专家证人在为一家公司辩护时,使用ChatGPT撰写报告。该报告涉及一起致命爆炸案的诉讼,专家证人试图通过AI生成的报告来论证该公司“0%的责任”。这一案例引发了关于AI在法律领域应用边界的讨论,包括AI生成内容的可靠性以及专家证人的责任归属问题。
另一个案例则涉及提示注入(Prompt Injection)技术。有人在法律文件中隐藏了提示注入指令,试图引导AI系统在阅读文件时做出有利于自己的判断。这一行为展示了AI系统在面对恶意构造输入时的脆弱性,也引发了关于AI安全性的新担忧。
Meta智能眼镜的隐私争议
此外,Meta公司的一项新专利也进入了公众视野。该专利涉及使用面部识别技术来识别佩戴者周围的人,并自动生成聚会等场景的精彩片段。这一功能设想引发了广泛的隐私担忧。与此同时,有研究展示了Meta的智能眼镜如何被用于骚扰女性,这进一步加剧了公众对于此类设备可能被滥用的忧虑。
这些案例共同勾勒出当前AI技术应用中的复杂图景:一方面,AI在效率提升和内容创作上展现出巨大潜力;另一方面,其在数据获取、隐私保护、法律伦理等方面带来的挑战也日益凸显。随着AI技术的普及,如何建立相应的规范和监管框架,将成为社会各界需要共同面对的问题。
热门跟贴