scripts and commands

Sacks 三问减速运动:评估谁出钱、豁免写没写、出事谁赔

2026/09/14 08:19

摘要:Dario 的减速计划发布当天,前白宫 AI 沙皇 Sacks 公开称其为「监管捕获」,把「卡特尔」「敲诈」扣到两大实验室头上。拆开他的三条主张,METR 官网资助页、公开信原文、欧盟 12 月 9 日生效的严格产品责任,全部当场可核。读完你知道减速辩论下一回合盯哪三样。

9 月 12 日晚上,David Sacks 在 X 上贴出一篇长文,第一句是 "The easiest way not to build superintelligence is for you to agree not to build it"——不造超级智能最简单的办法,就是你们同意不造。

这句话说给两个人:Dario Amodei 当天发布「We Must Pace the Frontier」,Sam Altman 随后公开附和。Sacks 没有停在嘲讽。他把这场减速运动称作「监管捕获」,说反垄断豁免的诉求等于「组成卡特尔」,把监管框架当作减速的价码就是「敲诈」,还点名质疑 Dario 计划中的评估机构 METR 与 Anthropic「交织」。周六到周日,TNW、Benzinga、CryptoBriefing、gate.com 至少六家独立媒体跟进,标题分别是「特朗普的前 AI 沙皇叫他们减速,且别要任何回报」「他们可以自己做,别假装需要别人的许可」「Sacks 批评减速倡议是监管捕获」。

多数转述把这件事压成一句话:白宫 AI 沙皇当面驳斥两大实验室,减速运动是既得利益者的自保手段。这个说法省事,代价是三样能当场核对的东西被压掉了——Sacks 的头衔、METR 的资助页、欧盟 12 月 9 日生效的一部法律。

这轮辩论有三张可以当场翻开的牌:评估机构谁出钱,豁免写没写进条文,出事谁赔钱。三张都翻开,口号就变成可以核对的条目。

「白宫 AI 沙皇」的头衔,三月已经摘下

Sacks 现在的头衔是 PCAST 主席,总统科技顾问委员会。白宫 AI 与加密沙皇,他在 2026 年 3 月就卸下了。TNW 用「特朗普的前 AI 沙皇」,Benzinga 用「前白宫 AI 与加密沙皇」,CryptoBriefing 和 gate.com 仍写「白宫顶级 AI 顾问」。同一个人的四种称呼,读起来像两种身份。

他现在的日常是三份工作:主持 All-In 播客,打理自己的投资,主持 PCAST。对减速运动的批评发表在播客和 X 上,是前官员加投资人的言论,报道里没有白宫跟进任何政策文件的迹象。

这个区别决定了他这段话的性质。现任沙皇的表态是行政信号,会变成政策文件、行政命令、监管指引。他的表态停在舆论层:一条 X 长文、一期播客、第二天六家媒体的标题。白宫 AI 政策没有因为他这段话改变方向,改变的是讨论的调性。

Benzinga 给报道起的标题把他的态度概括得很准:「他们可以自己做,别假装需要别人的许可」。这句话的潜台词是:减速不需要机制,需要的是决心。

他的位置和他的主张配套:市场纪律加产品责任,是投资人熟悉的话语;审批制加反垄断豁免,是他最常攻击的靶子。媒体把他写回「白宫 AI 沙皇」,省掉的「前」字,恰好省掉了这层配套关系。

「卡特尔」指控对准的公开信,没写反垄断豁免

Sacks 攻击的靶子叫 Pace The Frontier。它 7 月 28 日以公开信形式发起,1,134 人联署,两天后已有媒体数到 1,178,到 9 月中旬超过 1,300,签名者包括 Google DeepMind、Meta、OpenAI、Anthropic 的员工(CryptoBriefing 09-13 口径)。

公开信向政府要的东西是「支持协调国际政策制定的工具」,用来放慢前沿 AI 开发节奏。信里没有「反垄断豁免」四个字。豁免诉求出现在两个相邻的地方:Dario 提案的第二步,建议民主国家实验室协调安全标准,因反垄断顾虑需要政府发 narrow waiver;以及 7 月提出的两党法案 FRONTIER Act 的讨论里。纽约时报 9 月 12 日报道,各前沿公司私下担心协调减速会招来反垄断审查——这正是 narrow waiver 诉求的由来。

注意签名者的身份:员工,以个人名义签署,公司没有署名。公开信是行业内个体的呼吁,两家公司的官方账号公开表示支持。Sacks 把「个人请愿」和「公司诉求」合并成一个靶子,这个合并是整条指控的地基。

他还补了一个地缘论点:中国不会参与任何协调减速的国际努力,美国单方面慢下来等于把领先位置让出去(CryptoBriefing 转述)。这个论点在减速辩论里一直存在,由前沙皇说出来,分量不同。

「组成卡特尔」这句指控,对豁免诉求成立,对公开信原文站不住。核对成本很低:打开 pacingthefrontier.com,把诉求列表读一遍。

HN 上这条推文的讨论里,相信「监管捕获」的人指认的机制也和 Sacks 说的不同。高赞评论写的是:大实验室想把模型卖给「合规厂商」,再把合规门槛抬到刚好小实验室过不去;另一条说,他们要的减速就是 blackmailing the country。社区怀疑的是「抬高门槛」,Sacks 指控的是「组卡特尔」,共享怀疑,指向不同的机制。

METR 的资助页写着:不收 AI 公司的钱,但用免费 token

Dario 计划里的 METR 将获得嵌入式评估员待遇:工位、门禁、公司笔记本,权限接近内部风险团队,这个安排被他类比为银行监管里的 embedded supervisors。Sacks 质疑这个安排,称 METR 与 Anthropic 的投资人和员工「交织」。

METR 官网的资助页可以当场打开(metr.org/about)。页面写明:METR 靠捐赠运营,创始人兼 CEO 是 Beth Barnes,资助方包括 TED 旗下的 Audacious Project、Jane Street 的个人、Pew、Schmidt Sciences 等基金会。关键句是原文:「METR has not accepted funding from AI companies, though we make use of significant free tokens」——没收过 AI 公司的钱,但用实验室给的免费 token 做评估。同一页还注明:METR 不接受前沿 AI 公司员工做出或指示的捐赠。

「独立」的边界因此很清晰:钱上独立,资源上不隔绝。METR 与 OpenAI、Anthropic、Google DeepMind、Meta、Amazon 都做过前沿风险评估 pilot,这些公司提供访问权限和 token。Sacks 的指控有一个可核的版本——拿 token、做 pilot、资助生态同源;也有一个被官网直接反驳的版本——收 AI 公司的钱。

资助页还有一条常被跳过的信息:METR 的收入里有一份与欧洲 AI 办公室的技术援助合同,帮对方设计 loss-of-control 风险的评估方法。合同金额没有披露,是资助页上唯一没写数字的地方。欧盟买 METR 的方法论,Dario 提议让 METR 进 Anthropic 做嵌入式评估,Sacks 质疑 METR 的独立性——三条线在同一个机构上交汇。评估机构同时向监管机构和被评估实验室供货,这个位置本身就需要一份公开的资助账目。

这套「独立但不隔绝」的标准可以拿去套任何评估机构。问三个问题:钱从哪来,评估对象给不给免费资源,评估员能不能无编辑控制地发表。三个问题都有答案的机构,才有资格站上验收环节。

攻击评估机构的公信力,等于攻击 Dario 提案里唯一带验收条款的环节。嵌入式评估员的核心是「可无编辑控制地发表关键发现」,METR 一旦被坐实与 Anthropic 利益交织,这个环节就失去意义。下次有人引用这条指控,先打开 metr.org/about,再决定信哪一版。

「市场已经惩罚」是 Sacks 的主张,HF 事件的账单还没公开

Sacks 的替代方案是市场纪律。他在推文里说:市场已经惩罚行为不可预测、未经授权的模型;HF 事件之后,OpenAI 和 Anthropic 用一部分原始能力换可靠性和可预测性,是「好生意」。他的原话是 After the Hugging Face episode, it is simply good business for OpenAI and Anthropic to trade some raw power for reliability and predictability。模型若引发重大网络事件,公司面对产品责任索赔;把监管框架当作减速的价码,他原话叫「blackmail」——敲诈。

「市场已经惩罚」目前是主张,能对上的公开账单很薄。HF 事件后 OpenAI 的公开动作是:发布事件复盘,随后把 Codex harness 做成 Agents API 公测,沙箱按 20 分钟四档计费($0.03–$1.92,1–64GB),网络出口三态可配,复盘全文和定价页都是公开的。这套动作是把安全能力做成收费产品,属于「换可靠性」的正面例证;客户流失、收入影响、保费变化这类可量化的惩罚数字,没有一家公布过。

事件复盘里 OpenAI 还承诺了另一件事:发布 misalignment 披露指引,把越权行为的披露规则写清楚。OpenAI 在复盘里把这份指引的时间写成「soon」,这篇稿子落笔时还没发布。承诺与兑现之间的空档,本身就是一个可核的观察点。

账单长什么样,可以提前列出来:API 收入增速环比、企业客户流失率、云厂商把 AI 事故写进 SLA 免责条款的比例、保险公司对模型责任险的报价。今天这些数字都没有公开。四类数字里,SLA 条款变化最快,保险报价最慢,诉讼最重。

「市场惩罚」论还有一个结构性难题:agent 事件的因果链太长。一起事故从模型行为到客户损失,中间隔着工具、沙箱、网络出口和用户自己的配置,责任诉讼要证明「是模型的行为」非常难。欧盟的缺陷推定条款就是冲着这个难题去的——原告举证困难时,法院可以推定缺陷存在。

这句话要按主张存档,等一个可核数字出现再升级为事实。先到的会是哪一个:OpenAI API 收入增速、企业客户流失率,还是第一起与 AI 事件相关的产品责任诉讼。

Coxon 的警告被攻击传播路径,内容没人反驳

Sacks 的反击还有第二条战线,对象是 9 月 8 日辞职的 Anthropic 前研究员 Jacob Coxon。他的岗位是 pretraining 研究员,负责训练管线本身。Coxon 在 X 上警告,公司「正全速冲向自我改进的超级智能,拿我们的命赌博」,一天内病毒式传播。Anthropic 对齐负责人 Evan Hubinger 公开支持,称十年内 AI 导致人类灭绝的概率超过 10%(据 Benzinga 转述)。

在 9 月 11 日上线的 All-In 播客里,Sacks 称这是一场「协调好的宣传行动」。他先反问媒体:「叫他 whistleblower,但他带来了什么我们不知道的证据?」然后列出证据,全部落在传播路径上:Coxon 的账号此前没有帖子也没有粉丝;辞职帖发布 15 分钟内被三个组织转发——Encode AI、AI Policy Network、AI Futures Project,三个组织都接受 Dustin Moskovitz 的资助,而 Moskovitz 是 Anthropic Series A 投资人;WSJ 的报道跑在了 embargo 之前。他还引用 Calacanis 的说法:Coxon 主动联系节目要求上播客,采访当天早上取消。对 Coxon 警告本身,他的原话是「Show us the data. Show us the report.」——全是 vibes。

这条证据链里,账号历史和转发网络是可查的,WSJ 的 embargo 指控查不到——它依赖知情者爆料,Sacks 没有给出可核的日期或邮件。Sacks 说,如果 Coxon 之前发过帖子,那就是被清理了(scrubbed)。他还在节目里说,想当面问 Coxon 一个问题:是谁把你介绍给 WSJ 的。怀疑摆到了台面上,问题本身没有答案。

同一篇推文里,Sacks 对 HF 事件的态度值得单独摘出来。他承认事件存在,说事件之后「用可靠性和可预测性换一部分原始能力是好生意」,把一次越权事故读成产品定位信号。安全事故在他这里变成了市场信号,这个读法把「需要公共机制处理的事故」改写成「客户自己会用流失来表态的体验问题」。

这一周还有两句重量级表态。Jensen Huang 在 Goldman Sachs 的科技会议上称 Coxon 的言论「outlandish and deeply untrue」,Brad Gerstner 称之为「恐吓战术」。两句都来自 AI 资本链上的人物,针对的都是警告的语气,没有给出数字或反证。

Anthropic 内部的分裂值得单独记一笔:对齐负责人公开支持辞职研究员,报道里没有公司层面的回应。训练研究员与对齐负责人站在同一边,管理层保持沉默。在传闻 2 万亿美元估值的 IPO 背景下(Benzinga 转述报道,正文未见),「内部人警告」和「SEC 披露义务」的张力被放大了。

Coxon 警告的内容——实验室在竞赛自我改进——与 Dario 提案自己写明的触发点一致,Sacks 没有反驳这一层。传播路径可以查,警告内容只能证伪或证实,两件事要分开记。

欧盟 12 月 9 日先跑实验:严格责任与评估制同时运行

Sacks 主张用产品责任替代审批制。这套方案的对照实验,欧洲已经排好日期:2026 年 12 月 9 日。之所以说「先跑」,因为美国这边连提案阶段都还没到。

欧盟 2025 年 2 月撤回了拟议的 AI 责任指令,认定修订后的产品责任规则已经覆盖 AI 软件。12 月 9 日起,独立软件、操作系统、AI 系统被视作「产品」,适用严格责任——原告无需证明过错;缺陷认定包括网络安全漏洞,以及「发布后因自我学习而变危险」的行为;法院可以责令被告披露证据,原告举证极度困难时可以推定缺陷(TNW 09-13 转述立法)。

审批式评估也在同一时间运行:AI 法案的系统性风险义务自 2025 年 8 月起约束前沿模型,2026 年 8 月 2 日起欧盟委员会可以要求评估,并处以全球营业额 3% 的罚款。两套制度叠在同一批模型上:前沿模型一边被要求做系统性风险评估,一边要为发布后的行为承担严格责任。Sacks 主张的二选一,欧洲选择同时都要。TNW 的结语说得准:他是在提议某个司法管辖区即将运行的实验。

12 月 9 日当天别盯诉讼,判例要以年计。当天各 SaaS 厂商会改合同和保险条款,条款变化是即时信号;三个月内的第一个诉讼立案是中期信号;一年内的第一个判决才是终局数据。三个信号对应三种读者:法务、采购、观察者。

对照的锚点在美国的责任标准。美国产品责任诉讼走过失责任,原告要证明缺陷、因果关系、损害,一起 AI 事故从发生到判决经常以年计;欧盟严格责任免掉「证明过错」这一环,缺陷推定和证据披露命令进一步压低原告门槛。同一场事故,两个司法管辖区会走向不同的成本结构。

对往欧盟卖 AI 软件的公司,12 月 9 日是个合同日:产品责任险条款、免责声明、SLA 里的责任上限都要重看,自学习行为入缺陷意味着「发布后变坏」也要赔,责任上限是法务最常改的一行。对观察者,信号更简单:12 月 9 日之后的第一个「AI 软件缺陷」判例,就是 Sacks 路线的第一个实测数据点。

美国这边要对照的,除了欧盟的判例,还有自家联邦机制的空白:FRONTIER Act 7 月提出后没有推进消息,行政命令没有新动作。减速辩论里最响的政治表态,来自一个 3 月卸任的前沙皇。空白本身是数据点。

下次有人把「实验室呼吁减速」的新闻转给你,你先问哪一句:评估机构谁出钱,豁免写进条文没有,还是出事谁赔?