OpenAI将开始在欧盟为ChatGPT和Codex生成的文本添加隐形水印,以满足《欧盟人工智能法案》的透明度要求。该系统在模型生成的文字中嵌入隐藏的统计信号,读者看不到水印,但OpenAI的检测器可以分析文本以寻找该信号的证据。
这项技术的推出正值主要AI公司面临压力,需要标识合成内容。两个月前,Anthropic宣布为Claude文本推出全球水印系统。一些Claude用户对此表示反对,他们认为用户提供了指令、上下文和决策,而AI只是工具。OpenAI此前也开发过文本水印,但推迟了发布,据报道是担心用户转向没有类似限制的竞争服务。
OpenAI将其系统称为textGrain,通过微妙改变生成过程中所选词汇的统计模式来运作。公司预计,水印将在未来几周内覆盖所有欧盟套餐中的合格ChatGPT和Codex用户。全球API客户将获得单独选项,可为选定模型启用带水印的输出,默认设置保持关闭。
OpenAI还开放了文本水印检测器的申请,研究人员和专业组织将首先获得访问权限。这一谨慎的推出反映了当前检测技术的弱点。OpenAI称,其检测器可能产生误报,也会漏掉真正的水印。
OpenAI的测试显示,较长的段落让检测器有更好的机会找到信号。在200个Token的心理学段落中,它检测到约80%的水印;对于400个Token的段落,这一数字达到约95%。在数学领域,结果显著下降,因为作者在措辞上的选择更少。人工编辑带来更大挑战。将10%的词语替换为同义词,检测率从约92%降至66%;替换25%的词语,检测率降至约17%。翻译和大量改写也会削弱信号。
这意味着水印无法证明AI生成了整段文字,也无法衡量最终文本中有多少人类工作。阳性检测不能识别写作背后的用户、账户或对话,也无助于说明准确性、所有权或责任。水印缺失同样证明不了什么,短文本、编辑、翻译和不支持的模型都可能产生未被检测到的内容。
OpenAI计划将textGrain作为开源技术发布,并继续测试其性能。公司还希望研究翻译和编辑如何影响水印耐久性。Anthropic、Google、Meta、Microsoft和OpenAI已承诺遵守欧盟关于AI生成内容的实践准则。OpenAI已在支持的图像和音频中使用Content Credentials和隐形水印。公司表示,随着可靠性提高,将扩大检测器访问权限,并将根据技术证据和监管标准的发展调整方法。
37 0
登陆后参与评论
2026-10-07 09:44:21
2026-10-07 09:22:19
2026-09-29 08:34:12
2026-09-24 09:00:05
2026-09-23 09:02:16
2026-09-22 08:55:53
2026-09-22 08:51:52
2026-09-19 08:03:05
2026-09-14 09:04:05
2026-09-14 09:00:37
2026-09-14 08:51:14
2026-09-12 07:50:35