浣熊吃三明治的视频:谷歌如何展示其最新AI检测工具
一只浣熊坐在桌前吃着三明治。这段由颗粒感较强的夜视镜头拍摄的视频,正是谷歌用来展示其最新工具的素材。毕竟,这类视频在社交媒体上极易传播,人们往往未经深思熟虑便会将其分享。
谷歌提出了一个简单的问题:这是相机拍摄的真实画面,还是计算机生成的虚拟内容?这个问题正变得越来越难以回答。生成式人工智能(Generative AI)——一种通过输入提示词即可生成新图像、视频、音频和文本的软件——如今能在几秒钟内制作出令人信服的媒体内容。
自然杂志曾在2024年11月警告称,该技术“能够轻松制造出具有说服力的科学数据”。
隐形的数字签名走向公众视野
谷歌给出的答案是SynthID,这是由其AI研究部门Google DeepMind构建的系统。自2023年以来,该系统已在利用谷歌AI工具制作的媒体中嵌入了一种不可见的数字水印,这是一种肉眼或人耳无法察觉的隐藏签名。
10月7日,谷歌向全球用户开放了SynthID检测器。在此之前,该平台仅限媒体专业人士使用。现在,任何人都可以上传图像、视频或音频文件,以检查其中是否包含该数字签名。
其背后的规模相当可观。谷歌表示,截至目前,已有超过1800亿张图像和视频被添加了水印,以及长达24万年的音频内容。该公司称,已内置于搜索引擎、Gemini应用和Chrome浏览器中的验证工具,每天处理的需求量超过100万次。
检测器的明确边界
SynthID目前只能识别由谷歌或其合作伙伴(包括OpenAI、英伟达和韩国科技公司Kakao)生成的AI内容。苹果公司也即将加入这一行列。来自其他生成器的媒体内容可能不会被标记。
此外,该工具目前仅提供英文版本,且谷歌尚未公布具体的准确率数据。但其影响范围远不止一家公司。
微软联合创始人、现任盖茨基金会主席比尔·盖茨(Bill Gates)在8月26日的文章中写道:“由AI驱动的欺诈、虚假信息、深度伪造和监视是人们日常生活中将感受到的主要危害。”他还警告称,“AI将赋予目前权力相对较小的不良行为者更大的能力。”
而ChatGPT制造商OpenAI的首席执行官山姆·阿尔特曼(Sam Altman),作为SynthID的合作伙伴之一,对这种权衡有着不同的看法。他在10月4日接受《政客》杂志(Politico)Decoded栏目采访时说:“世界应该接受一些坏事的发生,以换取这项技术带来的好处。”他认为,人们利用该技术所做的善事将远远多于恶事。
尽管如此,此次发布标志着这一隐蔽的基础设施正式进入公众视野。辨别真实与合成内容,不再仅仅是新闻编辑室的专业技能,而正在成为一项日常必备技能。