ChatGPT推出文字水印 GPT-6提速50%

摘要:

很少有 AI 厂商笃信发布的产品能够“以数量换质量”,OpenAI 偏偏是其中之一。一如之前连开 12 天发布会的豪举,昨天,OpenAI Codex 负责人 Thibault Sottiaux(也就是大家熟悉的 Tibo)宣布了一项持续 28 天的承诺:接下来的每一天,团队要么发布一项对大多数 Codex 或 ChatGPT Work 用户有明显价值的更新,要么执行一次完整额度重置。


活动来到 Day 1,OpenAI 交出的答卷是提速。通过订阅使用 GPT-6 Astra 和 GPT-6.1 Sol,默认速度将提高约 50%,用户无需调整设置。

同一天,OpenAI 还公布了两项方向完全不同的变化。ChatGPT 和 Codex 的部分文字输出将开始加入不可见水印,ChatGPT 的广告业务则准备引入更直观的图片展示形式。

放在一起看,几项更新很能说明 OpenAI 目前的处境。它需要让付费用户觉得订阅更值,也需要向监管解释 AI 内容从哪里来,同时还得让越来越大的用户规模,成为广告主愿意买单的生意。

模型之外,AI 平台要面对的日常事务,正在越来越接近我们熟悉的互联网。

每天都要更新,用户期待一份可用的改进

Tibo 的承诺有一个值得留意的限定,每天发布的改进,需要与大多数 Codex 或 Work 用户相关,而且效果足够明显。

换句话说,一项藏在角落里的小功能,很难满足用户对这份承诺的期待。对于每天使用 AI 工作的人,等待时间、操作是否方便、额度够不够用,都会直接影响他们愿不愿意继续付费。

Day 1 的提速,正好回应了这种需求。

按照 Tibo 的说明,GPT-6 Astra 和 GPT-6.1 Sol 的默认速度优化覆盖 OpenAI 的订阅产品,也覆盖支持 Sign in with ChatGPT 的合作伙伴,包括 OpenCode、Pi、Amp 和 Devin。


用户通过 ChatGPT 账号在这些工具里使用订阅能力,也在此次调整的范围内。他表示,变化会在公告发布后的两小时内逐渐被用户感受到。

随后,Tibo 又给出了一个更具体的数字,生成速度从每秒 30 token 提升到每秒 50 token。


对于需要连续与模型交互的工作,提速仍然有实际意义。写代码需要反复读取文件、修改、测试和纠错,整理资料也可能经过多次搜索与生成,单次等待缩短后,累积下来的体验差异会更明显。

不过,比起提速,或许重置额度来的更实在些,我们也期待这 28 天能看到多几次。

给文字留下水印,也要承认水印的局限

提速让用户更容易使用 AI,文字水印则回应了另一个问题。当生成内容进入邮件、文章、报告和公共讨论,外界还能不能识别它与 AI 的关系?

同样是今天,OpenAI 公布了应对欧盟文字来源规则的方案。按照其公告,欧盟《AI Act》要求生成式 AI 提供商,让生成文字能够以机器可读的方式被识别。


全球 API 客户从当天起,可以为部分模型主动开启文字水印,默认状态仍然关闭。

未来几周,OpenAI 会在欧盟范围内,为符合条件的 ChatGPT 和 Codex 文字输出加入不可见水印,覆盖各类套餐,但首发阶段不会将它设为全球默认功能。

OpenAI 将这项技术称为 textGrain。它会在模型选择词语时加入不可见的统计信号,检测工具再寻找这些信号,判断一段文字是否含有 OpenAI 水印。OpenAI 还计划将技术开源。


难点在于,文字太容易被改动,而可供模型选择的表达方式,也因内容而异。

在目标误报率为 1% 的测试条件下,对于心理学等内容,检测工具能识别约 80% 的 200-token 水印文本,长度增加到 400 token 时,识别率约为 95%。数学内容的表达空间更小,检测表现明显更低。


编辑也会削弱信号。在另一组 400-token 文本测试中,将 10% 的词语替换为同义词,检测率会从约 92% 降至 66%;替换比例达到 25% 后,检测率只剩 17%。


几组数字说明,文字水印能提供线索,但距离可靠判断一篇文章的创作过程,还有相当大的距离。OpenAI 也表示,在其用于评估 Astra 的基准测试中,没有观察到加入水印前后存在有意义的性能差异,不过这些测试仍然不能覆盖所有实际写作场景。

更关键的边界,是水印无法衡量人类贡献。

一个人自己完成文章,再让 AI 调整表达,和让 AI 生成全文,都可能涉及模型对文字的处理。检测到水印,无法说明作者投入了多少判断、编辑与创意,也不能据此判定版权、责任或内容真假。

水印同样不会关联具体用户、账号、提示词或对话。反过来,没有检测到水印,也无法证明文字由人类独立完成,文本过短、经过编辑或翻译、来自不支持水印的模型,都可能让信号无法被识别。

由于误报和漏报仍然存在,OpenAI 暂时只向获批的研究人员和专业机构开放检测工具的申请,没有在上线时向公众全面开放。


当 ChatGPT 每周触达 12 亿人,广告开始长出熟悉的样子

比起水印,视觉广告更容易让普通用户感受到产品的变化。

OpenAI 在同日公告中称,ChatGPT 每周触达 12 亿人。对于这样规模的平台,订阅之外的商业收入,已经成为产品发展的一部分。

此次公布的新广告形式,将通过图片展示产品灵感、使用方式或相关体验。首批测试计划在本月晚些时候于美国启动,与一组初始广告主合作,展示场景选在 ChatGPT 生成图片的过程中。


按照 OpenAI 的说明,广告会被明确标注,并与正在生成的图片保持分离,广告也不会影响 ChatGPT 提供的回答。

选择图片生成作为测试场景,有它的商业逻辑。

用户在构思房间布置、活动方案或生活方式时,图片能让商品的使用场景变得更直观,也更容易让品牌进入用户的考虑范围。当然,是否能带来足够好的体验,还要等测试给出答案。

OpenAI 同时扩充了广告效果衡量工具,与 Hightouch、Tealium、LiveRamp 等平台合作,方便广告主将已有系统中的转化数据传回 ChatGPT Ads,并引入更多归因和效果评估伙伴。

对广告主而言,真正需要回答的问题是,用户看过广告之后,是否产生了购买,以及这些购买有多少原本就会发生。

OpenAI 公布了几组合作伙伴提供的早期结果。

DV Rockerbox 称,WeightWatchers 在 ChatGPT Ads 上的归因获客成本,比其综合付费搜索基准低 15.3%;WorkMagic 称,健康品牌 Dose 的增量购买中,67% 来自全新客户;Triple Whale 则称,Portland Leather 从 ChatGPT Ads 获得的访问者中,93% 是新访客。

此外,广告展示的位置,也需要新的规则。OpenAI 表示,会评估对话是否适合展示广告,避免在情绪脆弱、敏感或其他不适宜的语境中投放,并与 DoubleVerify、Integral Ad Science 探索品牌适配评估。


按照公告,这些合作方将在受控测试环境中评估相关保护机制,不会访问真实用户的私人对话。

传统网站的广告通常围绕页面内容,ChatGPT 的广告则出现在一段持续变化的对话旁边。平台越能理解用户当前想做什么,商业机会就越具体;同样,用户也会更在意,自己得到的建议究竟受到什么影响。

OpenAI 承诺广告不影响回答,未来我们也将拭目以待。

28 天更新承诺才刚开始,接下来每天会交出什么,仍然值得关注。不过,首日的几项变化已经让竞争的范围更清楚了,OpenAI 同时要经营付费用户的效率、生成内容的透明度,以及广告主的商业回报。

AI 平台越来越成熟,也越来越需要回答一个熟悉的问题。当它既是帮你做决定的助手,又是商家争取你注意力的地方,用户凭什么持续相信它?

查看评论
created by ceallan