Anthropic已限制华为AI芯片使用Claude Opus 5.5开发前沿模型

摘要:

Anthropic最新推出的Claude Opus 5.5除了带来模型能力提升之外,还被发现加入了一套针对前沿大语言模型开发场景的特殊限制机制。当用户利用Opus 5.5为新一代AI模型开发底层内核时,系统可能不会直接使用最新的Opus 5.5,而是自动回退到能力较低的Opus 5。更值得注意的是,目前发现这套限制似乎同时针对华为和亚马逊的部分AI加速器。

Anthropic在Opus 5.5的支持文档中解释称,该模型针对“前沿LLM开发”设置了专门的分类器,覆盖的任务范围比较有限,例如针对某些机器学习加速器进行内核开发。这类分类器的作用,是判断用户当前请求是否涉及前沿大语言模型自身的开发工作。一旦触发相关条件,Claude就会从Opus 5.5自动回退至Opus 5。

所谓AI内核,是指运行人工智能模型时最底层的一系列计算操作。内核负责决定模型如何使用芯片上的计算资源和内存,以及如何执行各种数学运算。由于这些操作直接决定数学计算如何映射到实际处理器上,因此内核设计会直接影响大语言模型的运行速度、内存占用、准确率以及推理成本。对于训练和运行最先进的AI模型而言,针对特定AI加速器进行内核优化往往是非常关键的一环。

这一限制最初是用户在Opus 5.5正式发布后的支持文档中发现的。Anthropic此前已经在部分模型中使用分类器,用来识别具有潜在风险的请求,而这一次则进一步把类似机制应用到了前沿AI模型开发领域。

Anthropic明确表示,这些限制并不会影响绝大多数传统人工智能、机器学习研究以及普通编程任务。只有涉及少数前沿LLM开发能力时,系统才可能触发回退机制。因此,对于普通开发者来说,Opus 5.5在日常编程、AI应用开发以及机器学习研究中的使用基本不会受到影响。

但在进一步测试之后,有用户发现,Opus 5.5似乎会特别识别部分AI芯片。根据目前公开的测试结果,这套分类器至少涉及华为昇腾950DT以及亚马逊自研的Trainium3 AI芯片。也就是说,如果开发人员使用Opus 5.5为这些芯片开发用于前沿大语言模型的底层内核,模型可能会自动切换到Opus 5。

华为芯片被纳入这一限制并不令人意外。Anthropic近年来一直在加强对中国实体获取其模型能力的防范,并将模型蒸馏视为一个重要的安全和国家安全问题。所谓模型蒸馏,是指通过大量调用一个能力更强的模型,提取其行为和能力特征,再利用这些数据训练另一个模型。Anthropic近期发布的威胁情报报告就披露,公司发现多个与中国相关的机构针对Claude的Opus系列模型开展未经授权的蒸馏活动,因此进一步加强了账户识别、请求拦截和推理过程保护机制。

Anthropic还在Opus 5.5中加入了更加严格的反蒸馏措施,包括限制API用户修改模型此前对话上下文,以避免通过反复操纵上下文提取模型的内部推理信息。公司表示,这类措施主要针对大规模、工业化的能力提取活动,而不是普通用户的正常使用。

因此,当Opus 5.5检测到涉及华为AI加速器的前沿模型开发请求时,限制机制可能具有明显的技术和地缘背景。不过,目前并没有足够证据表明Anthropic是专门针对华为设计了这一套规则,还是将特定类型的AI加速器整体纳入了限制范围。

真正令人意外的是亚马逊Trainium3也似乎受到同样影响。

亚马逊不仅是全球大型云计算企业,也是Anthropic的重要合作伙伴和投资者。Anthropic的Claude模型本身就通过Amazon Web Services提供给企业客户,而Trainium系列则是亚马逊自主研发的AI训练和推理芯片,用于降低云端人工智能计算对英伟达GPU的依赖。因此,如果Opus 5.5确实限制了Trainium3用于前沿模型内核开发,那么亚马逊反而可能与华为一起受到同一套技术限制的影响。

目前尚不清楚这种情况究竟是Anthropic有意为之,还是分类器在识别特定AI芯片时产生了意外的误判。相关测试显示,Opus 5.5似乎能够识别不同硬件平台,并根据请求内容决定是否允许使用最新模型,但Anthropic并没有公开说明为什么Trainium3会与华为950DT同时触发限制。

这种情况尤其值得注意,因为Anthropic此前一直强调其模型可以通过AWS等云平台广泛提供,而Opus 5.5目前也已经正式登陆Amazon Web Services、Google Cloud和Microsoft Azure等平台。如果未来这种限制扩大到更多用于训练先进模型的AI加速器,那么云计算企业和AI模型公司的合作关系可能需要在模型能力、硬件支持以及安全限制之间进行更加复杂的协调。

从技术角度看,Anthropic这次的做法也反映出一个新的趋势:随着AI模型本身开始能够帮助人类设计和优化下一代AI模型,模型厂商需要开始区分“使用AI开发应用”和“使用AI开发更强的AI”这两类任务。

对于普通程序员而言,让Opus 5.5帮助编写应用程序、调试代码或者进行机器学习实验,通常不会触发特殊限制。但如果同一个模型被用于开发下一代前沿大语言模型的底层计算内核,Anthropic就可能认为这已经进入另一个风险等级,并让请求自动回退到较旧的模型。

这意味着AI模型本身正在逐渐成为AI研发基础设施的一部分。过去,限制模型使用主要意味着限制某些危险内容或者敏感领域;如今,模型厂商开始进一步考虑“谁可以利用最新模型来制造下一代模型”,以及“最新模型是否应该帮助竞争者优化自己的AI计算基础设施”等问题。

目前,Anthropic并未公开说明Trainium3为何会与华为950DT同时触发限制,也没有明确表示这一机制是否会在未来版本中继续存在。随着越来越多企业开始开发自己的AI加速器,这种针对特定硬件和前沿模型开发任务的限制,很可能会成为AI模型厂商在安全、防止能力蒸馏以及硬件生态之间进行权衡时需要面对的新问题。

查看评论
created by ceallan