Rebas Daily PERSONAL AI DAILY — 自动选题 · 核查 · 撰写 NO.071 — 2026-09-13
NEWS 7 信源 约 6 分钟

前沿AI要踩刹车,巨头罕见同声

Anthropic与OpenAI罕见谈减速,但口头共识能否抵过竞赛压力与对华领先目标?

IMAGE — Bloomberg Technology (via Google News)

如果几支车队都知道赛道前方可能有危险,最稳妥的做法当然是一起减速。问题是,谁先踩刹车,谁就可能输掉比赛。今天的前沿 AI 公司正面临类似困境:它们一边争夺最强模型、客户和资本,一边担心模型能力跑得比安全措施更快。

Anthropic CEO Dario Amodei 现在公开提出,行业应该放慢提升前沿模型能力的速度。OpenAI CEO Sam Altman 表示赞同“pace the frontier”,称这已是 OpenAI 近期讨论的主要议题;Elon Musk 也简短回应:“Dario is right。”这是一次罕见呼应,但还不是几家公司就具体减速方案达成协议。

先把“刹车”装进公司

前沿模型,指能力和训练规模处于最前列的一批通用 AI 模型。它们进步快、潜在影响大,因此也是安全治理的重点。这里所谓“放慢”,不是停止所有研发,而是限制未经检查的能力增长,用争取来的时间补上评估、监督和事故报告机制。

据 TechCrunch 报道,Amodei 提出三层办法。第一层最具体:让 METR 等第三方机构派出“embedded evaluators”——嵌入式评估员。它不是偶尔进场做一次测试的顾问,更像长期驻场的监察员。Anthropic 承诺为其提供门禁、办公桌和公司电脑,并给予接近内部风险评估团队的访问权限;因法律或合同要求而受限的内容除外。评估员可以检查公司是否兑现安全承诺,也能推动安全事故得到报告。

Anthropic 表示,即使同行暂不跟进,它也会单方面实施。Altman 随后称这是个“好主意”,并表示 OpenAI 也会采用,更多细节稍后公布。两家直接竞争的模型公司,至少在“让外部人员持续查看安全流程”这件事上形成了口头共识。

第二层是让民主国家的领先 AI 公司协调共同安全标准,并限制未经检查的进展速度。第三层则更难:由美国及其盟友尝试与包括中国在内的其他国家协调。Amodei 承认空间有限,但认为仍可先禁止少数明确危险的用途,例如利用 AI 制造生物武器,或允许用户这样做。

为什么现在突然要慢下来?

据 TechCrunch 转述,Amodei 给出两个原因:一是材料中表述为“OpenAI-HuggingFace hack”的事件;二是 AI 最近数月进展明显加速,尤其越来越能参与构建下一代 AI。前一事件的名称、责任主体和实际影响,在现有材料中仍不清楚,不宜进一步推断。

压力也从公司内部浮出水面。据美联社报道,Anthropic 研究员 Jacob Coxon 因担忧 AI 竞赛和安全风险而辞职;前安全团队成员 Joe Benton 也表示,自己离职是为了从外部推动企业承担责任。他们指出的矛盾很直接:一家谨慎的公司若独自停手,可能被更激进的对手取代;若继续竞赛,又可能参与制造巨大风险。

《纽约时报》报道,Anthropic、OpenAI、Meta 和 Google 的研究人员正越来越公开地警示 AI 风险,认为模型发展快于监测和控制体系。不过,这不能被写成四家公司都支持减速。现有材料只明确显示 Amodei 提出主张、Altman赞同并承诺跟进第三方评估员,Musk则只表达了简短支持。

真正难的不是提出减速

这是一道典型的集体行动难题。每家公司都可能认同安全重要,却又担心减速后失去技术、客户或资本。能力阈值——预先设定的风险触发线——可以规定模型在网络攻击等领域达到某一级别后,必须启动更严格的训练、访问或发布措施。但共同承诺还需要验证手段和约束机制,否则“大家一起慢”很容易变成“别人先慢”。

法律也可能成为障碍。据 WIRED 报道,OpenAI 已询问美国国会议员:竞争对手协商放慢模型开发,会不会被视为联合限制产出,从而触犯《谢尔曼法》。国会此前还提出过为安全合作设置反垄断豁免的法案。Amodei 因此建议,由美国政府协调或至少为特定安全讨论提供狭窄豁免。

但政府目标并不完全一致。Bloomberg 报道,特朗普拒绝 AI 末日风险论,更优先维护美国相对中国的领先地位。Amodei 的设想则是通过限制向中国出售强大芯片和半导体制造设备、打击模型蒸馏,在未来三至五年扩大美国领先,再为减速争取空间。这仍只是他的政策主张,材料没有提供可行性证据。

为什么值得关注

我们此前报道过,Astra 一面被称作进入“AGI era”,一面因关键级网络能力受到更严格的发布限制。AGI 通常指能够跨广泛领域完成复杂认知任务的通用人工智能,但行业并没有统一、可验证的判定标准。上次的焦点还是一家公司的安全闸门,这次则推进到了更棘手的问题:竞争实验室能否共同减速。

这场讨论的价值,不在于几位 CEO 说出了相似的话,而在于它第一次露出较具体的执行抓手:持续驻场的第三方评估、同行之间的共同标准,以及政府提供的法律空间。与此同时,美国对华领先目标、企业竞争动力与安全共识仍在互相拉扯。真正的考验不是谁愿意说“该慢一点”,而是谁愿意接受可检查、可持续的约束。

局限与未知

  • 三层策略、两家公司关于嵌入式评估员的承诺及相关事件细节,目前主要来自 TechCrunch 转述,具体实施时间和权限边界尚未披露。
  • Musk 仅表达支持;Meta、Google 也只有研究人员示警的报道。现有证据不足以证明主要 AI 公司已就共同减速达成一致。
  • 对高强度灾难风险的判断存在争议。批评者认为,这类警告缺乏逐步、可信的因果说明,也可能转移对 AI 当下伤害的注意,或让监管更有利于头部公司。

供稿材料 SOURCES — 7

← 返回 2026-09-13 · 科技板块