亚洲财经

☰ 搜索

ChatGPT在欧洲添加隐藏文本签名,OpenAI遵守新规

TLDR

水印对修改的抵御能力如何?

内部测试显示,将25%的单词替换为同义词后,检测成功率仅降至17%。

为何检测工具保持私密?

访问权限仅限于经过批准的科研机构和专家组织。

获取3本免费的股票电子书

OpenAI在欧洲全面部署textGrain隐形统计水印

OpenAI正在欧洲地区的ChatGPT和Codex输出内容中部署一种名为“textGrain”的隐形统计水印。此举旨在满足欧盟《人工智能法案》(EU AI Act)中的透明度合规要求。

内部测试表明,当将25%的单词替换为同义词时,检测成功率仅降至17%。目前,检测工具的访问权限仍仅限于经过批准的科研机构和专家机构。

虽然在欧盟范围内这是强制性的,但全球范围内的API用户可以通过设置自愿启用该水印。

技术细节与实施背景

10月5日,OpenAI公布了在欧盟领土内的ChatGPT和Codex响应中嵌入隐形水印的计划。该公司表示,这一举措是对欧盟《人工智能法案》所规定的透明度义务的直接回应。

我们正在扩展内容溯源方法,以涵盖文本领域,以应对欧盟监管要求,同时认识到当前文本水印技术的显著局限性。我们的工具已经可以帮助验证图像或音频文件是否由我们创建……—— OpenAI (@OpenAI) 2026年10月5日

该倡议背后的技术被称为“textGrain”。它通过微妙地影响语言模型的选词过程,从而创建一个隐蔽的统计签名。随后,配套的检测应用程序会分析文本以识别这一签名。据OpenAI称,这种方法不依赖于隐藏字符、不可见空格或不寻常的标点符号。

因此,典型的规避策略(如从复制的文本中删除隐藏字符)无法消除水印。签名直接编织在语言模式本身之中。

水印对修改的抵御能力如何?

检测的有效性因内容长度而异。OpenAI使用“令牌”(tokens)来量化文本——即语言模型解释的词片段。大约一个令牌相当于四分之三个标准英语单词。

  • 在内部评估中,检测系统成功识别了约66%的未修改响应,这些响应的长度约为150个单词。
  • 当内容达到约300个单词时,成功率提高至约92%。

修改内容会迅速削弱水印的有效性。对于300个单词的段落,每10个单词中替换1个同义词,检测准确率便从92%降至66%。当每4个单词中有1个被替换时,检测率骤降至仅17%。OpenAI的内部发现表明,一旦文本经过编辑、压缩或改写,该系统面临重大挑战。

该公司还指出,水印的实施对其最新模型GPT-6 Astra的性能指标几乎没有影响。

为何检测工具保持私密?

OpenAI选择不立即广泛公开检测器。相反,访问权限将仅授予经过审查的研究人员和专门机构。

该公司澄清,阳性检测结果不会披露用户身份、输入提示或对话详情。阴性结果也缺乏确定性。简短、经过修改或翻译的内容可能逃避检测器而不触发警报。

由其他AI平台生成的内容也不会激活该系统,因为它专门搜索OpenAI的专有签名。OpenAI明确表示,未能检测到水印并不能确认人类作者身份。

视觉和音频内容遵循单独的验证流程。用户目前已可将这些文件类型上传至OpenAI公开的验证平台,以扫描其SynthID水印。

对于欧盟以外的地区,ChatGPT水印对普通用户默认处于禁用状态。然而,全球的API客户端可以通过其项目或组织偏好设置,为特定模型激活该功能。

此次部署紧随欧盟自8月开始实施的《人工智能法案》透明度条款。OpenAI将该水印定位为其对监管要求持续回应的一部分。

该公司还在声明中引用了更广泛的行业数据。TRM Labs的研究表明,AI工具的被犯罪利用情况同比增加了40%。

OpenAI尚未透露检测工具何时或是否会向公众开放。目前,欧盟的实施范围和受限的研究人员访问代表了该倡议的现有范围。