OpenAI正为ChatGPT和Codex生成的内容推出名为textGrain的隐形水印,欧盟用户将默认启用该功能。公司表示,未来几周内将开启水印,以满足《欧盟人工智能法案》关于生成文本须能以机器可读方式标注的要求。使用OpenAI API的开发者则可以自行启用或关闭水印,这与Anthropic的做法不同:后者会在全球范围内强制为所有Claude输出加上水印。
水印的工作原理与局限
textGrain会在模型选词中嵌入一种统计模式,原理类似于Google的SynthID,Anthropic的Claude也使用了SynthID。OpenAI的内部测试显示,检测器能在约95%的400-token(约300词)心理学文本中识别出这种模式,但对于长度相同的数学文本,识别率只有约60%。即使只改动少量文本,检测率也会下降:将10%的词替换为同义词,识别率就会从约92%降至66%;替换四分之一的词后,识别率则降至约17%。
检测器的使用权限
目前,OpenAI只会通过申请流程向部分研究人员和专业机构开放检测器。该工具只会报告文本中是否存在OpenAI水印,不会透露文本作者或使用过的提示词。
为什么重要
欧盟用户的ChatGPT输出将带有隐藏标记,监管机构可以读取这一标记,帮助OpenAI满足新的标注规定。开发者可以选择关闭标记,这可能影响第三方识别AI生成文本的难易程度。编辑文本后检测率会大幅下降,这意味着用户只需适度改写内容,仍可能去除水印。