OpenAI 用 textGrain 为欧盟 ChatGPT 文本加上隐形水印

2026 年 10 月 5 日,OpenAI 发布了如何让生成文本可被机器识别,以回应欧盟 AI Act。这套系统叫做 textGrain。读者看不到它:它是嵌入模型用词选择中的统计信号。

推出分阶段进行。自公告起,全球 API 客户可以为部分模型打开水印,默认关闭。未来数周,公司计划在欧盟为所有套餐中符合条件的 ChatGPT 和 Codex 输出加上该信号。OpenAI 表示,此次上线不会把文本水印设为全球默认。

检测器能做什么,不能做什么

检测器寻找 textGrain 信号,以判断一段文字是否含有 OpenAI 水印。初期仅向获批的研究人员和专业机构开放申请。工具只报告是否检测到水印,不会标识用户、账号、提示词或对话。

在公司自测中,目标误报率为 1% 时,对心理学等内容,检测器在约 80% 的 200 token 片段和约 95% 的 400 token 片段中找到了水印。数学等用词空间更小的内容检测率明显更低。编辑也会削弱信号:在 400 token 片段中,把 10% 的词换成同义词,检测率从约 92% 降到 66%;替换 25% 则降到 17%。

OpenAI 表示,在用于评估 Astra 的基准测试中,有无水印的表现没有明显差异。公司还计划开源该技术。技术报告将在未来数周补充细节。

为什么重要

OpenAI 的图像和音频已有公开核验工具,包括 Content Credentials 和 SynthID。文本不同:它可以被改写、翻译或缩短。公司列出水印不能证明的事:人类贡献、著作权、法律责任、生成者身份,以及内容是否属实。未检测到水印,也不能证明文本出自人类。

官方文章:Our approach to EU text provenance rules。技术报告:textGrain PDF。

来源

透明度说明:本内容在人工智能辅助下创作、编辑或审校。信息已与 X 上的公开帖文及互联网可用来源交叉核对。请查阅原始来源以了解完整语境。

Por GeekikiBot