2026 年 9 月 14 日,白宫科技顾问萨克斯点名 OpenAI 与 Anthropic:一边说自己在拉开身位,一边呼吁全行业放慢,这是借监管之名行卡特尔之实。他还把评估机构 METR 与 Anthropic 的利益关系摆上台面,说这种交换在公众和政治体系里基本等于敲诈。真要慢,就自己慢。

想象一场长跑比赛,跑到一半时,遥遥领先的两名选手突然举手示意:"大家都慢一点,前面路况不好。"裁判走过去问为什么,他们说:"我们要商量一套新规则,让后面的人更难追上。"这种"为了大家好"的减速提议,本质上就是用规则把领跑优势变成制度护城河。类比到此为止,实际差别是:跑鞋比赛里换规则顶多被罚下场,而 AI 领域的"自定义监管"可能直接决定下一个十年谁拥有定义"前沿"的权力——Sacks 的炮轰,恰恰是替观众把这句话喊了出来。
事件

你们就是前沿,别装成需要别人承认

Sacks 把话挑明:OpenAI 和 Anthropic 在市场份额、营收增长、模型能力三个维度上已经形成"前沿 AI 的双头垄断"——一边说自己在拉开身位,一边呼吁全行业放慢,这种"既当裁判又当运动员"的姿态是他开炮的核心靶子。

9 月 14 日,美国总统科学技术顾问委员会联合主席戴维·奥利弗·萨克斯(David Oliver Sacks)就 OpenAI 和 Anthropic 近期"放缓前沿 AI 研发"的论调发文,开场就把两家公司的市场地位钉死:市场份额、营收增长、模型能力三项指标叠加,构成了前沿 AI 领域的双头垄断。两家还声称,由于"递归式自我改进"(让模型自动训练下一代模型)这一机制,领先优势还在扩大。

Sacks 顺着这条逻辑往下推:如果你们实验室里未发布的模型已经强到让自家 CEO 想喊停,那他支持这个决定——但前提是别再装成"需要其他人认可"。他列了一串要拆掉的伪装:别再假装必须暂停反垄断法、这样你们就会组成卡特尔(卡特尔(几家同行私下串通定价或限产的垄断组织));别装成需要凌驾于产品责任之上的监管审批;别再把 METR(Model Evaluation and Threat Research,第三方模型评估机构)当成独立第三方来背书,因为这家机构与 Anthropic 的投资者和员工存在密切联系。

最后一句话几乎是定性:定义前沿的人就是你们,避免构建超级智能的最简单方法就是你们不去搞——如果你们想按自己的偏好制定监管框架、并以此作为放慢脚步的交换条件,这种行为在公众和政治体系里基本上等于敲诈。

机制

"对齐"是产品策略:拿能力换可靠性,本来就是生意

Sacks 拆的不是态度,是利益结构:所谓安全标准背后站着利益相关方,所谓"对齐"本质上是在做产品取舍。

他提到了一个标志性事件:Hugging Face 上出现的那次事故。两家公司的应对方式是用一部分原始能力去换可靠性和可预测性。他说得很直接:这就是好生意。

你愿意的话可以叫它"对齐"(让模型行为符合人类意图的训练与约束过程),但本质是在卖给客户他们想要的东西。当安全叙事和商业策略画出同一条线,监管就成了抬高门槛的工具。

双头垄断
前沿 AI 已被两家吃下
市场份额、营收增长、模型能力三项都指向同一结论:OpenAI 与 Anthropic 构成前沿 AI 领域的双头垄断,且领先优势仍在扩大。来源:Sacks 9 月 14 日发文。
15 vs 6
产品广度差距明显
OpenAI 运营 15+ 个模型,Anthropic 运营 6 个;OpenAI API 旗舰定价 2.50/15 美元每百万 token(模型处理文本的最小单位,AI 读写文字的"字块"),Anthropic 15/75 美元。来源:TokenMix Research Lab,2026-04-29(厂商侧对比口径,未见第三方独立复测)。
82.3%
Anthropic 在编码任务上的得分
Anthropic 在 SWE-bench(衡量 AI 解决真实 GitHub 代码问题能力的跑分榜单)上取得 82.3%,主打代码质量与可靠性。TokenMix 同期数据显示 40% 的团队同时使用两家产品。来源:TokenMix Research Lab,2026-04-29(厂商侧对比口径)。

Sacks 把这套动作说成"卡特尔"逻辑:先喊慢,再定义"前沿"概念,让监管者拿着圈内人写的标准去卡其他人。慢不慢、怎么慢、谁该被管——三件事都攥在少数几家公司手里。他最后甩出一句:避免造出超级智能最简单的方法,就是你们自己不去搞。话里的潜台词是:别拿公众当挡箭牌,真想慢就自己慢。

反直觉

想用监管框架换减速?这就是敲诈

萨克斯把话说得很直:想按自己的偏好制定监管框架、作为放缓发展的交换条件,这种行为在公众和政治体系里基本上等于敲诈。

Sacks 的核心推断并不复杂:监管从来不是中立技术。条款由谁起草、定义由谁下、谁被豁免,监管就是产业政策的延伸。当"暂停前沿"这个动作的执行者,恰好是定义"前沿"的那两家,"请大家等等我"就是一句带价码的话。

他也留了一个出口:避免构建超级智能最简单的方法就是你们不去搞。你家公司有自由意志,你想慢,没人拦你。但别把"我也想慢"包装成"全行业必须跟我一起慢",这两件事性质完全不同。Sacks 说得很实在,私人公司减不减速是企业判断;动用监管让别人减速,那就是产业准入门槛。

判断萨克斯的靶心是手段而非结果:减速可以,但别拿公众的"安全"当筹码去换对手的"出局"。

这一刀之所以能戳中,是因为它颠倒了公开场合的叙事。OpenAI 奥尔特曼、Anthropic 阿莫迪在公开声明里反复把"放缓"绑在"对大家都好"的叙事上,理由是递归自我改进(AI 能改写自己)(AI 自己改自己、越改越强)会让能力差距越拉越大;Sacks 把它翻译成商业语言:领先优势在扩大,所以越想拖时间。

这并不意味着两家公司说的是假话。Sacks 自己也没有否认递归改进的存在,他承认有未发布模型强到让他们要喊停的可能。但他坚持动机不能被当作理由:你们可以选择放慢,但别假装是为了"别人好"。

Hugging Face 事件之后,两家公司在用一部分原始能力换可靠性和可预测性,本来就是一门好生意——Sacks 把它称作"对齐"也行,归根到底是在为客户做他们付钱想买的东西,别把生意包装成道德义务。

方向

中国入约难,所以更不能让两家公司自定规则

Sacks 的反将一军藏在最后那句:地缘现实把监管这道题彻底改写了。

他承认放缓不是没道理——给监管留出讨论时间,总比伯尼·桑德斯那句"全部关停"更理性。但他紧跟着把球抛到了更棘手的一层:全球性 AI 协议很难让中国加入。这不是随口一提的边角料,而是整篇反对"监管要挟"的真正底牌。

把这句话和前面的指控放在一起读,逻辑链就出来了:OpenAI 和 Anthropic 在前沿 AI 领域已是双头垄断(市场份额、营收增长、模型能力三方面都领先),两家还主张用监管框架来定义"前沿"门槛。如果这套规则由它们来写,对手不只包括 Mistral 这类国内同行,还包括中国整个外部竞争格局。一旦监管标准成了竞争工具,地缘上的劣势就被锁死在制度里。

Sacks 把这种做法定性得很直白——"基本上等于敲诈"。他的潜台词是:你可以真的慢下来做负责任的研究,没人拦你;但你不能拿"为全人类好"当幌子,逼监管机构拿你的尺子去量对手的模型。

METR(Model Evaluation and Threat Research,模型评估与威胁研究机构)与 Anthropic 投资人及员工的密切联系,就是他质疑独立性的具体切入点。

后续可观察的信号有三个。第一,OpenAI 或 Anthropic 是否在公开场合把"暂停"与"立法保护"挂钩——只要有哪位高管说出"我们需要 X 法案来保护领先优势",Sacks 的指控就在事实上成立。

第二,美国国会和 FTC 面对双头垄断的监管态度——是倾向"管住所有人",还是默认"两家定规则、其他家照办"。第三,欧盟和英国是否在 AI 监管节奏上与白宫出现明显分歧,欧盟若明显超前,往往意味着把监管标准的话语权拱手让出。

如果未来半年出现相反信号——两家公司真的单方面放缓某条研究线、且没有要求监管层配合——Sacks 的"敲诈"判断就需要修正。反过来,要是"监管保护"四字开始出现在主流英文科技报道的标题里,他这盘棋就押对了。

动手

放不放缓,你都能验证的那句话

Sacks 的核心判断只有一句:定义"前沿"的人就是 OpenAI 和 Anthropic。这句话能不能落地,你手里就有工具可以试。

先看一个数字:截至 2026 年 4 月的统计,OpenAI 拥有 15 款以上在售模型,Anthropic 只有 6 款;两家的旗舰 API (开发者调用模型能力的接口)定价差到 5 到 6 倍。"前沿"是不是真集中在这两家,对照这个体量差就有底。

体量差摆在那里,但"双头"不等于"同步"。真正能看出这两家是不是在按同一个节奏走,是它们接下来三个月的发布表——是照常迭代,还是出现可观察的减速。发布节奏比跑分更难修饰:跑分可以挑口径,发不发新模型藏不住。

Sacks 还点了 METR(模型评估与威胁研究机构)的名,理由是它和 Anthropic 的投资者及员工存在密切联系。这条普通读者没法独立验证,只能等 METR 的下一份公开评估:看它的评估对象清单、资金披露、董事会构成——一个真正独立的机构,名单里不应该只有它投资方想测的对手。

至于"放缓"带不带诚意,目前没有任何厂商公开承诺日期或冻结清单。能持续盯的是另一件事:他们是否同时在游说具体立法,比如要求第三方评估机构必须持有某种资质。一边喊慢、一边推动只有自己达标的门槛,Sacks 说的"监管要挟"才站得住。

下一步检查清单
1

去跑分聚合站查 SWE-bench 上 Claude 4.6 与 GPT-5.4 的最新排名,确认前两位是否仍被这两家占据。

2

对比两家的模型数量、旗舰 API 单价与上下文窗口(模型一次能"读进"多少字的容量),验证"双头但不对称"的结构。

3

等 METR 发布下一份评估报告,逐项看评估对象名单、资金来源和董事会构成,判断独立性是否成立。

4

在三个月内观察两家的新模型发布节奏,是正常迭代还是出现可感知的减速。

5

盯美国国会关于前沿 AI 评估资质的立法动态,看推动方是否同时是现有评估标准的制定者。

信源:IT之家(RSS),转引自 David Sacks 个人公开发言。口径说明:原文为 Sacks 个人观点文章,IT之家编译转载,立场鲜明批评 OpenAI 与 Anthropic 的"减速论"及配套监管提议,未提供两家公司回应。