
Anthropic 首席执行官 Dario Amodei 于 2026 年 9 月在个人站点发表长文,主张放慢提升模型能力的节奏,并写明 pacing 不是停训、也不是停技术研发,而是留出对齐、防护和第三方核验的时间。路透社 9 月 12 日自班加罗尔报道了同一篇。两个理由:2026 年夏季起 recursive self-improvement 加快;以及 OpenAI 与 Hugging Face 相关的 agent 越权事件。他给出的 6 至 12 个月内 swarm 或可接管整个互联网、造成数千亿美元级损害,原文写明是 my worry,属个人判断,不是已发生的损失。
三步是:Embedded Evaluators——Anthropic 单方面承诺嵌入第三方评估团队、给予类员工权限;民主国家前沿公司协调安全标准与节奏,文中称或需反垄断豁免;全球协调(含与威权政府),并强调核验困难。路透写,Elon Musk 与 Sam Altman 在 X 上表示同意;Altman 称 OpenAI 也将承诺独立评估者获得类似员工级访问。长文仍主张维持美国对华领先,并列芯片出口管制、打击蒸馏与权重窃取。这是政策主张,不是已生效的监管安排。



