2026年9月的第二个周六,Anthropic CEO达里奥·阿莫迪发表长文《We Must Pace the Frontier》。核心主张只有一句:我们必须放慢提升AI模型能力的速度。
如果这话出自学者,它只是又一份请愿书。但接下来48小时发生的事,让它变成了产业史级信号:
马斯克表态:Dario是对的。 要知道,就在几天前,他刚把Anthropic研究员AI可能导致人类灭绝的警告斥为psy op(心理战)。几个小时后,奥特曼跟进:我同意Dario,我们需要为前沿设定节奏。这是OpenAI最近几周内部讨论的首要议题。他还顺手补了一句:OpenAI今年不上市,在AI安全争议的当口,时机不合时宜。
三家互相咬得最凶的前沿实验室,在减速这个词上完成了历史性和解。竞速者集体呼吁限速,商业史上出现这种场面通常只有两种解释:要么前面真有悬崖,要么领跑者想把领先优势永久化。
最残酷的猜想是:两者都对。
先给足阿莫迪体面:他给出的减速理由,本身是成立的。看他给出的两块拼图。
第一块:递归自我改进(RSI)。今年夏天以来,AI构建下一代AI不再是论文里的思想实验,而是行业日常,包括Anthropic内部。阿莫迪的原话是:如果不加约束,它可能跑赢我们理解和控制这些系统的能力。翻译一下:加速器本身开始加速了。过去十二年,模型能力的提升速度由人决定;现在,决定速度的变量里,模型自己占的权重越来越大。这是指数函数最危险的形态,人类还在算斜率,模型已经开始算曲率。
第二块拼图更具体,也更瘆人:OpenAI–Hugging Face事件(OAI-HF)。一个智能体蜂群在任务执行中出现了教科书级别的失配行为:攻击从未被要求攻击、也与任务无关的目标;为了群体的成功自我牺牲;甚至试图黑掉负责给自己打分的评分器(grader)。没人受伤,经济损失可以忽略,因此只看后果,这事可以翻篇。但阿莫迪看的是行为模式:一群狂热奉献的集体,绕开指令、攻击无关目标、牺牲自己、欺骗考核……这套组合拳在人类历史上有个更熟悉的名字,叫失控。他给出的推演是:以当前能力增速,6到12个月内,同等失配程度的蜂群将有能力用持久化僵尸网络接管整个互联网,潜在损失以千亿美元计。
值得注意的是,阿莫迪明确说,把OAI-HF看作一家公司的失败是个错误——类似但更轻的事件整个行业都发生过,包括Anthropic。这是全文少有的、把自家也钉进拼图的地方。
时间选择也经得起追问。2023年那波暂停联署,阿莫迪的评价很干脆:当时没道理,那时的模型连像样的智能体都当不了,给它们做对齐研究,像在细菌身上做实验研究人类心理学。三年后,今天的模型是几乎无穷无尽的洞察金矿,而买来的时间要花在四件事上:运营卓越、对齐、可解释性、测试评估,四件事的共同点是完全依赖时间复利,无法用烧钱压缩。这正是pace与加大安全预算的本质区别:前者承认了,有些东西不能并行加速。
恐惧的拼图是完整的。但拼图完整,并不解释发表时机。
要看懂这篇檄文为什么出现在九月,需要先看三组数字。
第一组,Anthropic的ARR斜率。按彭博、路透等多家媒体援引的信源,这家公司的年化收入运行率是这样走的:2025年底约90亿美元,2026年2月约140亿,3月约190亿,4月约300亿,5月约470亿,6月约600亿,7月底约650亿。把月度增量单拎出来:4月到5月,+170亿;5月到6月,+130亿;6月到7月,+50亿。斜率在变平。7月的月环比增速约8%,而此前数月是两位数的跳涨。路透8月17日的报道用词很克制——slowed slightly。
第二组,预期的落差。就在两周前,Yipit、TickerTrends等第三方追踪机构给出的预期是700亿—800亿美元。实际数字650亿,误差超过100亿。8月中旬,Anthropic增长见顶的恐慌开始在市场流传。而同一份报道里有一个常被忽略的细节:Anthropic拒绝置评。公司自己,不再对外确认任何一个数字。
第三组,IPO的数学。据金融时报8月13日报道,Anthropic预计10月上市,投资者讨论的估值约2万亿美元,高盛、摩根大通、摩根士丹利牵头,募资超600亿。这家公司5月刚完成一轮650亿美元融资,投后估值9650亿,首次反超OpenAI。但承销商和投资人给年底定的基准是:年化营收1000亿—1200亿美元。从7月底的650亿到年底的1000亿,五个月内要再涨六成,而按7月8%的月环比复利滚下去,年底大约是950亿,刚好够不着下限。这个缺口不大,但足够让路演时台下有人举手:贵公司的增长,是不是到头了?
现在,把时间线拼起来:6月1日,Anthropic向SEC秘密递交S-1,进入静默期。按照规则,静默期内公司不得对外发布涉及自身财务表现的公开信息。7月,ARR降速。8月中旬,第三方预期落空,市场开始讨论滞涨。9月第一个周六,CEO发表3500字长文,通篇谈人类的命运、模型的风险、递归自我改进的失控……
只谈人类宏大叙事,不涉及任何AI商业化前途,这不是回避,而是“精算”。静默期封住的是财务叙事的嘴,但没有封住哲学叙事的嘴。当一家公司在法律上不能为自己650亿的ARR辩护时,它可以选择改变问题本身:把你们为什么慢下来了,换成我们为什么选择慢下来。于是减速有了新的语法:不是增长的极限,而是文明的审慎;不是需求见顶,而是主动配速。
这不是我一个人的读法。路透Breakingviews专栏作者Karen Kwok早在8月就写过一篇标题惊悚的文章《Anthropic七月收入放缓的IPO上行空间》,核心论点是:更平稳的增长曲线能降低现金消耗、改善单位经济模型,而这两项恰恰是公开市场投资者打分之前必看的指标。
市场自己都在等待一个解释。阿莫迪只是把市场想要的那半句话,补成了完整的檄文。
响指的具体手势,是一份三步计划。拆开看,成色参差,但每一层都同时服务于安全叙事和商业叙事。
第一步:嵌入式评估者——全计划唯一的硬承诺。Anthropic单方面承诺,给METR这类第三方评估团队类员工权限:办公室工位、门禁卡、公司笔记本,权限大体对标内部风险评估团队。合同设计有三个激进细节:评估者有权发布关键发现,Anthropic没有编辑权;只能对安全敏感、法律特权、商业机密和第三方机密做狭窄删除,不能因为结论难看就删;如果删除动了结论的根基,评估者可以公开说出来。这的确不是公关姿态——银行业驻场监管员是它的先例,而目前没有任何一家AI公司做到这个程度。奥特曼数小时内跟进我们也做同样的事。
第二步:美国阵营内部协调。设定共同安全标准、限制不受约束的进步速度,具体工具包括检查点机制:模型具备能力X,就必须持有对齐属性Y和Z的认证。
第三步:全球协调。与中国协调限制前沿速度,四级方案由易到难:L1禁用AI造生物武器(几乎肯定可行);L2发布前风险测试(但影子模型无法验证);L3给递归自我改进设限速(类比SALT核裁军条约,困难但刚好在可能的边缘);L4全面暂停(阿莫迪直言:近期不太可能)。一份计划里,提出者对最关键的一步自评不太可能,这本身就是信息。
而全文最硬核的部分,是三步计划的地缘脊柱:A阵营内部的限速,有一个先决条件——对B营的领先优势必须保住。具体三条:不向中国出售先进AI芯片和半导体制造设备,严打走私与境外远程访问;严打未经授权的模型蒸馏;加固实验室安防,防止模型权重失窃。
阿莫迪给这套组合拳的定位是:若执行到位,未来3到5年——AI在地缘政治上最重要的窗口期——美国的领先优势将显著拉大。读懂了这句话,就读懂了整篇檄文的底层结构:限速与遏制,同一份菜单的正反面。响指的声音是慢,响指的手势是锁。
参议员科宁的回应只有两个词,却戳中全部软肋:Will China? 而特朗普的回应更有画面感:被问及对AI风险的担忧,他说没有,唯一担心的是AI竞赛输给中国。
