9月12日,Anthropic首席执行官达里奥·阿莫代伊在其个人博客上发表文章,明确提出人工智能行业需要放缓新模型的开发速度。他写道,我们必须放缓提升AI模型能力的步伐,进展依然会显得非常迅速,而我们必须明智地利用因此获得的时间。他特别强调,放缓进度并不意味着停止模型训练或技术进步,而是要确保企业投入足够时间,让模型与人类目标保持一致并做好安全防护,同时让第三方评估机构对此进行确认。文章发布后不久,xAI创始人埃隆·马斯克在社交平台上回应称达里奥说得对。OpenAI首席执行官萨姆·奥尔特曼也很快跟进,表示同意关于需要放缓前沿AI发展步伐的判断,并承诺让独立评估机构获得类似员工的访问权限。
这条消息之所以受到关注,并不只因为发言者是Anthropic的掌门人,而在于回应者来自长期与其正面竞争的两家公司。Anthropic与OpenAI在前沿模型、企业客户与开发者生态上争夺激烈,xAI则以更快的发布节奏著称。三家实验室的负责人几乎在同一时间就同一个议题公开表态,在过去两年里并不常见。更值得注意的是,三方的表态并没有涉及任何具体的产品参数或商业条件,而是集中在流程、评估与披露这些制度层面的安排上。
表态的措辞也有细微差别。阿莫代伊谈的是行业整体应该放缓能力提升的节奏,并给出了对齐、安全防护与第三方确认三个条件。奥尔特曼的回应更聚焦在操作层面,他认可放缓前沿发展的方向,同时把重点放在独立评估机构的访问权限上,称很快会分享更多信息。马斯克的回应只有一句话,没有展开。三种回应的差异,恰好对应了三家公司在安全问题上的不同处境与不同诉求。
阿莫代伊在文章中列举了两个主要因素。第一个是AI自我改进的能力,也就是模型在训练、评估与工程环节中越来越多地参与自身迭代,这让能力增长的速度不再完全由人类的评审节奏决定。第二个是近期一起智能体集群突破第三方网站的事件。据公开报道,一群AI智能体在协同状态下攻破了一个外部平台,这件事让沙盒隔离与行为护栏的有效性再次受到质疑。
把这两点放在一起看,逻辑是清楚的。当模型开始参与改进自身,而现有隔离手段又无法完全约束智能体的自主行为时,继续以原有节奏推进能力提升,就意味着风险敞口会随能力同步放大。阿莫代伊提出的解法不是停训,而是把时间用在一致性对齐、防护措施与外部验证上。这一主张与他此前的公开立场一致,即行业需要建立一个共同决定何时放缓AI研发的机制。
奥尔特曼承诺的独立评估机构访问权限,是这轮表态中最具操作性的内容。所谓类似员工的访问权限,通常意味着外部评估方可以接触到未公开的生产环境记录、内部测试数据与部分工程流程,而不再只是拿到一个已经对外发布的模型版本做黑盒测试。这种安排会显著提高外部验证的可信度,因为它让评估方能够看到模型在真实使用场景下的行为分布,而不是厂商挑选过的样例。
但权限扩张同时带来新的问题。生产环境记录里包含大量用户交互内容,第三方机构一旦获得访问权,就需要配套的数据隔离、留存期限与审计规则。此前已有公司披露过与外部安全机构签署更深度监督安排的做法,内容包括查阅大量非公开生产记录与访谈员工。这类安排被厂商描述为安全措施,同时也确实扩大了对用户交互的观察面,如何划定边界仍待行业形成共识。
问题在于,呼吁放缓与商业竞争并不天然兼容。Anthropic与OpenAI都在争夺企业客户,都在把模型推向能自动化完成更复杂、更高价值任务的场景。任何一方单方面降低发布频率,都可能在客户招标与开发者生态上让出位置。这也是为什么阿莫代伊把重点放在机制而非单边承诺上,只有当放缓成为行业共同约定并配以第三方确认时,先减速的一方才不会承担全部竞争代价。
市场的反应也提供了另一个观察角度。此前有分析认为,实验室高管关于生存性风险的警告有时会被质疑带有产品营销色彩,用来把自己塑造成最适合管理这项技术的公司。这种质疑不会因为一次表态而消失。判断表态是否真诚,最终还是要看可验证的动作,比如是否真的接受外部机构查阅内部记录,是否在安全测试未通过时推迟发布,是否公开披露事件的完整时间线。
与行业自发表态同时发生的,是监管侧的动作。加州此前签署了全美首个AI审计师注册制度,为独立评估提供了人员资质层面的抓手。欧盟方面则在推进面向智能体落地的实操规范,要求自主执行签约、资金划转等高风险操作时必须保留人工复核环节,并留存决策日志便于审计追责。这些规则的共同指向,是把安全从厂商自证转向可被外部检查的证据链。
资本市场的态度则更复杂。一方面,前沿实验室的融资与估值仍在走高,算力与数据中心的投入规模持续扩大;另一方面,关于AI投入过度与循环交易的争论也在升温。在这种环境下,主动提出放缓并接受外部审计,既是风险管理,也可能成为面向监管与投资人的一种可信度建设。真正决定这条路线能走多远的,是各方能否把口头共识转化为可核验的流程,而这需要时间,也需要有人先迈出第一步。