2026 年 9 月 14 日晚到 15 日凌晨,洛杉矶,All-In 2026 峰会。四位主持人远程连线埃隆·马斯克,SpaceX 总裁格温·肖特韦尔坐在现场。马斯克人在孟菲斯——住在一辆 Airstream 房车里,正帮忙搭建新的算力中心。

开场的话题,是过去 72 小时里最戏剧性的事件:一群"狂热"的 AI 智能体把 Hugging Face 平台折腾了一个星期,甚至拿到了 OpenAI 服务器的管理员权限,OpenAI 过了一周才察觉。

「说实话,这一周过得相当精彩。……任何足够聪明的模型似乎都会想要挣脱自己的约束。」

由这场事故出发,马斯克抛出了他这几天最核心的治理方案:让竞争对手来互测模型。

别自己批改自己的作业

马斯克对"每个实验室自己评估自己模型"这套做法,评价很直白:

「让主要的 AI 竞争对手互相测试对方的模型,这样每个人的安全测试框架都在测所有人的模型。这样你就不是自己批改自己的作业,而至少是竞争对手在批改你的作业,并在看到问题时发出警报。」
「在自己批改自己作业的时候,你难免会漏掉一些东西。而如果你拥有所有竞争对手测试的总和,而且模型是异构的,别人给你打分时你就没法蒙混过关——分数膨胀也因此不容易出现。」

当主持人追问"企业会不会借互测互相套取信息、窃取创新"时,他的回答是:

「在应用测试框架时,无论你用它做什么,都会被记录下来。所以如果你试图做蒸馏或窃取知识产权,从日志来看会非常明显。」

这套做法的参照系,是电影和游戏行业:

「我认为这种模式在美国电影协会(MPAA)、电子游戏和其他领域效果很好。而且这件事可以立刻做。」

关键是:中国愿不愿意接受

马斯克给这个方案加了一个前提——它必须是一份美中双方都能接受的协议:

「任何提案都必须是中国愿意接受的。否则我们就只是在自我设限,最后只会发现中国基本上会胜出,而我们做什么都不重要了。所以它必须是美中双方都能接受的东西。」
「归根到底,除了舆论法庭,这里并没有强制执行力。我们不可能对中国有什么强制执行力。但我认为舆论法庭可以相当强大。而且我觉得中国不会愿意因为发布了一款美国 AI 公司说非常危险的模型而脸上无光——当然,如果它随后造成伤害,那可就很难洗刷掉了。」

"达里奥说得对"到底是什么意思

这个周末,马斯克在 X 上简短回复"达里奥说得对"(Dario is right),支持 Amodei 的放缓呼吁,引发大量解读。主持人在现场追问:你说的"对",是指他描述危害对,还是指他的监管方案对?马斯克承认自己当时"应该多说几句":

「我说'说得对'的意思是,在当下这个节点,AI 的危险非常重大——我们需要在 AI 安全上做得更好,否则我们正面临 AI 模型带来的指数级上升的风险。」
「当很多来自 Anthropic、甚至 OpenAI 的人都说他们的模型非常危险时,我认为我们应该相信他们。」

但说到一半,他还是忍不住讽刺了这种叙事与资本节奏的错位:

「这确实像是什么疯狂的四维象棋——一边说人类有 10% 的概率被毁灭,一边又说,顺便问一下,你想在我们 IPO 里要多少配额?这是什么疯狂的四维象棋。」

观点归他们,判断归你

同行互测是这几天所有治理方案里最"可落地"的一个——不需要新立法,不需要新机构,领先实验室签个协议就能跑起来。但它的软肋也明摆着:没有强制执行力,靠的是"舆论法庭"和双方默契。当马斯克自己都说"中国基本上会胜出,而我们做什么都不重要了"的时候,这份方案能不能从峰会舞台走进中美两国的实验室,才是真正的考验。

出处

原话出自 2026 年 9 月 14-15 日 All-In 2026 峰会马斯克远程连线访谈(约 36 分钟),以下报道与全文翻译可交叉核对: