
据媒体报道,OpenAI正为其ChatGPT及编程代理Codex生成的文本添加隐形水印,以便机器更轻松地识别内容是否由人工智能生成。这一变更在欧盟将成为强制要求,而全球其他地区的API用户目前可选择加入。
技术原理与部署计划
大型语言模型通常根据前文逐词生成文本。OpenAI的新文本水印系统“textGrain”通过调整选词逻辑,使模型在决策时同时考虑前文语境和由密钥确定的伪随机值。这种机制会在生成内容中留下统计信号,AI检测工具可通过识别这些伪随机值来判断文本是否由AI生成。
未来几周内,该水印功能将在欧盟地区的ChatGPT和Codex中逐步上线。全球API客户也可针对部分选定模型启用该功能,但因默认关闭,需用户主动选择开启。
检测局限性与官方声明
目前,OpenAI的文本水印检测工具仅向申请访问权限的研究人员和专家开放。公司表示,限制访问部分源于技术的局限性,尤其是在处理较短段落时。测试显示,该工具在200字长的AI生成段落中检测成功率为80%,而在数学等词汇受限领域,检测率更低。
此外,人工编辑会显著削弱检测效果。在400字的段落中,若仅修改10%的单词,检测率将降至66%;若替换25%的单词,检测率进一步跌至17%。
OpenAI强调,文本水印仍是早期技术,存在显著局限。它无法确立内容归属权、证明准确性或识别提示者;同样,缺乏水印也不能作为内容由人类创作的证据。
合规压力与行业对比
此举旨在回应欧盟《人工智能法案》。该法规于2024年签署,自2025年起逐步生效,大部分条款已于今年8月2日适用。其中第50(2)条要求AI提供商确保输出以机器可读格式标记,并可被检测为人工生成或篡改。对于8月2日前发布模型的提供商,需在12月2日前合规,否则面临高达全球年收入3%的罚款。
媒体报道称,OpenAI的年经常性收入(ARR)已接近700亿美元。据此估算,违反规定可能导致超过20亿美元的罚款。
此前,Anthropic也宣布其AI聊天机器人Claude将根据欧盟规则对生成内容进行水印处理。与OpenAI不同,Anthropic的水印面向全球所有用户开放,而非仅限欧盟地区。
披露:Ziff Davis是Mashable的母公司,于2025年4月对OpenAI提起诉讼,指控其在训练和运营AI系统时侵犯了Ziff Davis的版权。