AI 日报 | 10-06:文本水印来了,官方把它的失效条件也一起写了

AI 日报 | 10-06:文本水印来了,官方把它的失效条件也一起写了

:fire: 文本水印从论文话题变成了合规现实,而且这次官方把检出率的上限一起公布了。

OpenAI 为符合欧盟 AI 法案分阶段引入隐形文本水印 textGrain:全球 API 客户即日起可自愿开启,EU 的 ChatGPT 与 Codex 在数周内生效。同一批消息里,它还在图像生成场景试起了视觉广告,并把两个模型的默认速度提了上来。

头条 | textGrain:不加可见标记,也不识别作者

机制上,它在模型选词时嵌入不可见的统计信号,检测器据此判断文本是否可能由 OpenAI 模型生成。官方明确:不加可见标记,也不识别作者、组织、账号或对话来源。技术报告已经放出,官方还计划把这项技术开源。

落地分三步:即日起全球 API 客户可对部分模型自愿开启,API 中默认关闭;未来数周为 EU 境内的 ChatGPT 与 Codex(所有档位)加水印,不做全球默认;检测器只向获批研究者与专家机构开放申请。

对照看,Anthropic 对 Claude 采用全球强制水印,OpenAI 走的是区域化加 API 自愿这条路线。

文本水印的三阶段与检出数据

图 1:textGrain 的三阶段落地、检出率与改写后的衰减。自制图。来源:OpenAI 官方页《EU text provenance》(2026-10-05),检出数据为厂商自测。

水印真正的边界写在官方自己的免责里:短文本与受约束文本更难检出;在 1% 目标误报率下,约 200 token 的心理学科目文本检出率约 80%、400 token 约 95%,数学类显著更低。改写会削弱它——400 token 文本替换 10% 近义词后从约 92% 掉到 66%,替换 25% 后只剩 17%。

官方还给了一张 8 项能力指标的对照表,结论是加水印前后未见有意义差异。要看清它的性质:那是同一个模型加与不加的对照,不是模型之间的能力榜。

基准 无水印 有水印
AA Intelligence Index 49.57 49.76
AutomationBench 34.09% 34.86%
DeepSWE v1.1 72.80% 71.68%
Terminal-Bench 4.0 53.90% 56.06%
Terminal-Bench Science 0.1 56.90% 60.00%
BrowseComp 87.92% 87.35%
HealthBench Professional 64.27% 64.60%
GPQA Diamond 94.44% 93.94%

图像里开始出现广告,先在美国小范围试

OpenAI 推出新的视觉广告格式,初期只在 ChatGPT 的图像生成过程中测试:广告明确标注,与生成的图像分开,官方称不影响 ChatGPT 给出的答案。测试本月晚些时候在美国启动,先面向一小批广告主。

规模口径来自官方:ChatGPT 每周触达 12 亿人。测量侧接入了一批归因与测量伙伴,广告定价没有披露。

三条早期效果数据——WeightWatchers 的归因 CPA 比其付费搜索混合基准低 15.3%、健康品牌 Dose 的增量购买 67% 来自新客、Portland Leather 的访客 93% 是新访客——都是合作方口径,不是第三方独立测评。

对象也要分清:这跟 2026 年 1 月那版「回答底部的文字广告」不是一回事,这次是图像生成场景里的视觉广告格式。

ChatGPT 视觉广告格式示意

图 2:ChatGPT 视觉广告格式的产品示意,广告带「Ad」标注。来源:OpenAI 官方页配图。

记忆正在被当成文件管,第三家也这么做了

Cognition 为 Devin 推出 Dreaming:跨会话构建记忆图、记录工作偏好,并在夜间做自我改进——清除过期记录、发现潜在信息。同时开源 Agent Memory Repo:记忆记录存放在文件里,用 Git 做版本管理。官方称这是「简单的原语」,但解锁了跨智能体会话的消息板这类用法。

这不是孤例。前一天的头条 CLM 把上下文当成一个文件让模型自己改,更早的 GitHarness 把需求与工作像 Git 提交一样存。三家独立做法趋同,说的是同一件事:把智能体的状态管理做成显式、可版本化的文件,而不是隐式记忆。

三家做法的对照

图 3:三家把状态做成文件的对照。自制对照卡。来源:arXiv 2609.37725、Cognition 官方 X(2026-10-06);GitHarness 为转述口径。

另外三条:一个研究预览、一次提速、一个监管首例

Reka 发布 190 亿参数的模型 Rho-1 研究预览版,在单一网络内处理文本、图像、视频与机器人动作。它是研究预览版:除参数量与模态外,没有公开规格,也没有基准分和价格。

OpenAI 把 GPT-6 Astra 与 GPT-6.1 Sol 的默认速度提升了约 50%(50 TPS,此前为 30 TPS),覆盖其全部产品以及通过 Sign in With ChatGPT 接入的合作伙伴。这是厂商口径,没有第三方复核。

还有一条只有转述来源:Nolla Health 据称成为美国首个获准由 AI 开出初始处方的机构,范围限犹他州成人的轻中度痤疮;处方转给持证药剂师,医生在早期逐例审核。目前没有官方文件可核。

另外三条的口径

图 4:Rho-1、默认提速与 Nolla Health 三条的口径。自制信息卡。来源:Reka 官方 X、OpenAI 员工 X、经 Rohan Paul 转述(2026-10-06)。

速览:另外六条

  • TikTok 推出 AI 购物助手与一键结账,可在信息流里直接向品牌购买。来源:TechCrunch(10-06)
  • 华为与高通达成 5G 等专利交叉许可协议。来源:IT之家(10-06)
  • 施耐德电气以 226 亿美元全现金收购 PTC。来源:IT之家(10-05)
  • Anthropic 的人工审查员将用户威胁对话上报警方,该女子随后被捕。来源:经 Rohan Paul 转述(10-06)
  • Suno 上线专辑功能,可设封面、编排曲目并发布。来源:Suno 官方(10-06)
  • computer use 被视为智能体的下一个主战场:大量软件没有可用 API,GUI 是通用接口。来源:Yuchen Jin X(10-06)

积木观察

今天的主线可以合成一句话:输出侧在加可追溯性(水印)、加变现方式(广告)、降延迟成本(提速),状态侧在把记忆做成文件与版本。

两个可执行的判断。如果你的产品面向 EU 用户、或经 API 输出文本,先确认水印的开启状态与检测接口的申请条件,别等它默认生效才发现。如果你在做 agent,Agent Memory Repo 是开源的,可以直接照着它的「文件加版本」这套原语,评估要不要替换现在的隐式记忆。

结尾互动

你更在意输出被追溯,还是更在意它不被误判?评论区聊聊。

来源链接

官方来源

独立来源

  • 与 Anthropic 强制水印的对照:The Decoder
  • Rho-1 的第三方报道:The Decoder
  • 默认提速:OpenAI 员工 X(Tibo),无第三方复核
  • Nolla Health:经 Rohan Paul 转述,无官方文件