Anthropic大瓜被扒出:“AI灭世”背后,居然是一门生意?

Anthropic大瓜被扒出:“AI灭世”背后,居然是一门生意?

AI 有这么可怕吗?

最新一期的时代杂志封面直接用了 Claude 的聊天窗口,对话框里正在输入「How dangerous are you? 你到底有多危险?」

封面标题则写着「The AI Tipping Point AI 的临界点」,时代在 X 发文,「今年夏天,AI 展现了其令人恐惧的能力。如今,一些研究人员、CEO 们,都正以前所未有的力度发出警报。」

的确如此,过去一周,从 Anthropic 研究员 Jacob Coxon 一篇离职的帖子在 X 上走红,他说无论是 OpenAI 还是 Anthropic,这两家他曾经就职的公司,都没有意识到 AI 的威力,他们是在拿人类的生命风险去开发所谓的 AGI。

目前该帖子已经获得超过 1.7 亿次的浏览量,甚至比 GPT-6 Astra 模型发布的帖子 1.36 亿次浏览量还要多。

当这条因为担心 AI 失控而离职的帖子传播开来之后,奥特曼、Dario、马斯克意外地站在一条阵线,公开呼吁应该减速,甚至是暂停对 AI 的研究。

原本更多集中在 AI 安全研究所,以及一些小圈子的 AI 末日论组织里的争论,一下子变成了主流的议题。

而我们普通人似乎也就这样被拉到了这套叙事里,开始思考超级智能究竟会不会失控。

很简单的道理,如果 AI 末日论是真的,AI 将来真的会强到取代我们所有人的工作,无论是简单的打工人,还是高级到那些 CEO 们,都会被取代。

但如果这是假的,AI 只是一场泡沫,是这些前沿 AI 公司的营销,那等到泡沫破裂,曾经因为 AI 而催生的行业和岗位又被裁撤,那些真金白银的投资,以及我们现在做的所有事情,似乎是又会变成一场空。

所以,既然结果都一样,那些焦虑的意义何在。

昨天,美国调查博主 Kevin Bass 在 X 发表了一篇长文,并把完整的证据放在 GitHub 上。

他深扒了 Anthropic 资金模式,发现这段时间以来的 AI 末日论里,其中暗藏着一个巨大的阴谋。

钱的力量

在 X 上已经有将近 600 万人在围观这件事,向来对「AI 末日论」嗤之以鼻的杨立昆也转发了这条帖子,进一步推高了热度。

Kevin Bass 的指控链条,可以用一句话概括:Anthropic 不只是在寻求所谓的 AI 需要监管,而是构建成了一台接好电的永动机,让所谓的 AI 需要监管,AI 末日论永远掌握在 Anthropic 手中。

这些阴谋可以被下面这张图总结,即 Anthropic 的早期捐助者,与评估机构 METR 相关组织之间,有通过慈善中介机构进行的真实公共资金重叠情况。

图|中文简化版

METR(Model Evaluation and Threat Research)是一家模型评估与威胁研究组织,前身是从 ARC(Alignment Research Center 对齐研究中心)分拆出来。

Anthropic CEO Dario Amodei 曾公开提议,前沿 AI 模型应该由「第三方评估机构」来做风险评估,并点名这个第三方就是 METR。

但 Kevin Bass 认为,从资金流向的问题上来看,METR 根本不「第三方」。

METR 所处的 AI 安全生态,资金高度集中在 Coefficient Giving(即原来的 Open Philanthropy)及其关联机构手上;而这个捐赠体系的源头,是 Facebook 联合创始人 Dustin Moskovitz 早年以个人名义买入的 Anthropic 股票

Forbes 估算这笔股份 2025 年初约值 5 亿美元,并报道它已被捐入某个非营利载体。

当 Anthropic 的估值暴涨,这笔「不到 0.8%」的股份也从 2025 年早期的 5 亿美元,按照 Anthropic 今年 5 月 Series H 融资后约 9650 亿美元的投后估值推算,9 月理论上限来到了 77 亿美元。

图|英文版原图

图|英文版原图

Kevin Bass 晒出的资金流证据具体到了个位数。

从 National Philanthropic Trust 的税表显示,FY2025 一年其 2.2 万余笔拨款中,流向 Founders Pledge 7882 万、RAND 6165 万、FAR AI 1442 万美元。

在他看来,这些全是「METR 网络」的输血管道。同一笔钱还流向 Tarbell Center 这样的 AI 新闻机构:Coefficient 的三笔拨款共约 529 万美元(2024 年 11 月 81.6 万、2025 年 3 月 288.8 万、7 月 158.8 万),其研究员的文章陆续在 TIME、The Verge、LA Times 等媒体上制造声量。

于是,一个「完美的」正反馈回路就出现了:Anthropic 估值越高,依赖这笔股票的安全生态越有钱,「AI 末日」的叙事喊得越响;而当这些机构不断谈论 AI 灾难,社会越害怕,就越需要第三方的独立评估;新的拨款和权力又回到熟悉的一群人手中。

但无论怎么转来转去,这些第三方评估机构的工资,在 Kevin Bass 的调查下看来,甚至就是 Anthropic「给」的。

评估者在被评估者的工资单上。如果 Anthropic 死了,整个评估机构和末日机器都会瘫痪,所以他们谁也不能允许 Anthropic 出事。

这段时间以来的 AI 末日论,就变成一台接好电的永动机,根本找不到关掉它的地方。

股票涨,拨款涨;风险叙事升温,评估需求又涨。

METR 一边参与定义风险,一边成为所谓的第三方评估者。

AI 会不会导致「世界末日」

Kevin Bass 这篇文章确实给了一些不一样的视角,他从财经的角度来分析这些 AI 公司高涨的「AI 末日论」,试图证明这个圈子既参与制造风险议题,也承接解决风险所产生的预算、权限和裁判权。

但也有网友发现这份分析报告,即便数据详实,还是存在很多禁不起推敲的地方。

例如没有找到具体的某一笔 Coefficient 或 Good Ventures 等基金会直接给 METR 的拨款。

其次,即便 METR 收钱了,也不能因此就将这些联系作为第三方机构的「骗局」,或者将其解读为一场无法停止的资金倒置。

图|Kevin Bass 给出的证据,METR 的许多资助者同时也是 Anthropic 的投资者。

图|Kevin Bass 给出的证据,METR 的许多资助者同时也是 Anthropic 的投资者。

于是,当整个行业都在讨论「谁来评估前沿 AI」的时候,评估者的独立性到底应该用什么标准来衡量?资金来源披露到什么程度才算够?人员流动、人际关系和免费算力,又算不算利益冲突?

实际上,AI 末日论最特殊的地方,正是在于它很难真正输掉。

图|由 AI 生成近期的 AI「太强」新闻拼贴

图|由 AI 生成近期的 AI「太强」新闻拼贴

模型能力继续提高,突破各种沙盒和变身「黑客」发起攻击,以及在一个又一个千禧年大奖难题取得进展,就足以证明危险正在逼近。

而如果 AI 造成的严重事故没有发生,可以归功于预警和安全工作;当 AI 监管开始介入,说明此前的警告是对的;监管迟迟没有跟上,又会成为争取更多资金和权力的理由。

于是,AI 的繁荣开始供养批判 AI 的末日论,末日论又反过来证明这些公司掌握着足以改变人类命运的技术。

GPT-6 Sol 和 Opus 5.2 又快发布了,核弹爆炸后瘫坐在椅子上的奥特曼,每隔一段时间就出来「踩刹车」的 Dario,以及不断刷新能力上限的新模型,都在继续为这套叙事提供新的素材。

下一次模型突破、下一次安全事故、下一篇离职长文出现时,「AI 会不会毁灭世界」的争论大概还会重新开始。

但 Kevin Bass 这场争议至少提醒了另一件事:当我们讨论 AI 风险时,不能只盯着模型到底有多危险,也得看看是谁在定义「危险」,谁负责评估危险,以及围绕这些判断建立起来的制度,又在如何重新分配资金、监管权和话语权。

毕竟,AI 最先改变世界的方式,可能还不需要等到超级智能出现。

只要所有人都相信它可能出现,就已经足够了。