OpenAI于周一宣布,已开始为欧盟地区用户使用ChatGPT和Codex生成的文本添加可识别标识。此举旨在满足8月2日正式实施的《欧盟人工智能法案》中关于内容透明度的要求。
根据法规第50条,人工智能企业需以机器可读方式对生成内容进行标记。违规者可能面临最高1500万欧元或全球年营业额3%的罚款。该功能将在未来几周内逐步覆盖欧盟所有付费账户,现阶段仅适用于本地用户。
尽管开发者可通过API在任意地区激活此功能,但必须手动开启,否则默认处于关闭状态。
OpenAI推出的textGrain系统通过在多个合理词汇选项间施加微弱偏向来实现水印嵌入。这种决策累积成统计特征,肉眼不可见,但可通过专用工具识别。
由于水印直接编码于文本语义结构中,而非依赖文件元数据,因此即使复制粘贴至其他平台,仍可被追踪。该技术由OpenAI联合宾夕法尼亚大学与耶鲁大学研究人员共同开发。
系统采用密钥控制词汇排名,当足够多的选择体现相同模式时,具备相同密钥的软件即可判定该文本源自OpenAI模型。公司强调,水印不包含任何用户身份信息,且测试显示启用后GPT-6 Astra性能未受影响。
测试表明,仅替换10%的词汇(如同义词替换),便使检测准确率从92%降至66%。短文本、数学答案及翻译内容中的水印更难被捕捉。
因此,OpenAI暂将检测工具限制在授权研究机构和专家团队使用。同时提醒,无法检测到水印并不能证明文本由人类撰写——可能是篇幅过短、修改频繁,或出自其他厂商模型。
水印仅反映部分内容可能经由OpenAI系统处理,无法衡量其中人类参与程度或创意占比。
与OpenAI的区域性部署不同,Anthropic自8月起已在全范围对Claude输出进行水印标注。这并非出于政策更严,而是因当时技术尚未支持按区域控制。
两家公司均已在7月签署欧盟人工智能生成内容透明度行为准则,该倡议已有谷歌、Meta、微软、Mistral等约190家组织加入,共同响应同一项监管要求。
Anthropic的全面推广引发争议,部分用户认为其在协助写作中角色较轻,不应承担全部责任。
据《华尔街日报》披露,OpenAI早在数年前即已构建文本水印系统,但因担忧用户转向无水印服务,故长期未公开。