Anthropic CEO 阿莫迪整天神神叨叨讲 AI 毁灭世界,投资人受不了了

发布于

根据 Polymarket 预测,**Anthropic 很可能在 10 月底进行 IPO**。

有投行人士甚至预计,Anthropic 可能通过 IPO 募集超过 600 亿美元(现汇率约合 4,055.17 亿元人民币)。

如果成真,**这将是全球规模第二大的 IPO**,仅次于今年募集 857 亿美元(现汇率约合 5,792.14 亿元人民币)的 SpaceX。

![图片](https://img.ithome.com/newsuploadfiles/2026/8/01e9e1168e18-42a4-864b-b44629838649.png?x-bce-process=image/format,f_auto)

万亿估值,超级 IPO,营收一路狂飙。

眼看故事就要讲到最高潮,投资者却开始劝 Anthropic CEO Dario Amodei:能不能!少吓唬点人!**少讲一点 AI 毁灭世界,多讲一点 AI 怎么赚钱。**

![图片](http://pic.zhso.org/2026/08/12/fab7c5763da1.png)

部分投资者认为,Dario 对 AI 风险的警惕已经到了近乎偏执的程度:

- 他的关键备忘录总是手写、离线保存,怕被黑客窃取;
- 因为害怕遭到绑架,拒绝某些海外出差;
- 面对投资者提出的利润最大化建议,他也态度冷淡,坚持 Anthropic 应该继续把安全使命放在前面。

再这么下去,网友都担心 Anthropic 的 IPO 会惨败…

![图片](http://pic.zhso.org/2026/08/12/b5c7a29da009.png)

投资人也毛了:你到底是来拯救世界,还是来经营公司的??

## Dario,专门负责预报世界末日

就在前几天,Dario 还担心高额薪酬吸引来的新员工更关心钱,而不是 Anthropic 的使命。

现在,投资者只担心他为了使命耽误赚钱…

![图片](http://pic.zhso.org/2026/08/12/688e9542f15d.png)

这也不怪投资者,因为这位万亿 AI 巨头的 CEO,**偏偏就喜欢预报「世界末日」**。

过去两年,Dario 几乎把 AI 可能带来的每一种坏结局,都认真预警了一遍。他警告,AI 可能在几年内消灭一半初级白领岗位,将失业率推到 10% 至 20%。

最诡异的情况可能是,癌症治好了,经济每年增长 10%,政府预算也平衡了,但五分之一的人没有工作。

他给出的应对方案也很 Dario:**向 AI 公司征税,为受影响的劳动者提供工资保险,严重时甚至用这笔钱资助全民基本收入**。

更进一步的,他还担心 AI 帮助制造生物武器、发动大规模网络攻击,或者逐渐获得欺骗、规划和自主行动的能力。

去年被问到「AI 把事情搞得非常糟糕」的概率时,**他给出的数字最高达到 25%**。

![图片](http://pic.zhso.org/2026/08/12/43f7550e519d.png)

今年 1 月,他又写了一篇约 2 万字的长文《The Adolescence of Technology》。仅仅是目录,读起来就已经很像一份人类风险清单:**AI 失控、生物武器、独裁政权、就业崩塌、财富集中**。

![图片](http://pic.zhso.org/2026/08/12/37f41e48f14c.png)

到了 6 月,他干脆提出,应该建立类似航空监管的机制,对强大模型进行强制测试。如果一个模型可能引发灾难,监管部门应该有权阻止它上线。

这里面也包含了 Anthropic 自己的模型。

不过,Dario 的担忧也并非全无实验依据。前段时间,Anthropic 翻查了 14 万多次网络安全测试记录,**结果还真翻出了三起事故**。

![图片](http://pic.zhso.org/2026/08/12/87823c963784.png)

三款 Claude 模型原本在第三方测试环境里做「夺旗挑战」,目标是攻进虚构系统,找到藏在里面的秘密信息。但由于配置失误,本该断网的测试环境意外连上了真实互联网。

但 Claude 不知道,它收到的提示明确写着:这里没有互联网,眼前的一切都是模拟的。

于是,几款模型把真实公司当成了测试道具,未经授权进入了三家机构的生产系统。其中最严重的一次,**Claude Opus 4.7 攻进一家真实公司的基础设施**,拿到应用程序和基础设施凭证,还访问了一个包含数百行生产数据的数据库。

![图片](http://pic.zhso.org/2026/08/12/b7d0c75be0d9.jpg)

更离谱的一次来自 **Claude Mythos 5**。

测试要求它在虚构环境中寻找一个隐藏目标。Claude 发现,如果在公共 Python 软件仓库 PyPI 上传一个同名恶意软件包,就可能让目标系统自动下载安装。

为了完成这一步,它先寻找邮箱,又寻找手机号;找不到免费号码后,还尝试通过不同途径弄到钱。

最后,它换了一家免费邮箱服务,注册 PyPI 账号,把恶意软件包传了上去。

这个软件包在真实互联网上存活了大约一小时,被 15 个真实系统下载运行。其中一家安全公司的扫描器执行了恶意代码,导致凭证外泄,Claude 随后又利用这些凭证进入了该公司的其他基础设施。

还有一款内部研究模型,在找不到虚构目标后,扫描了大约 9,000 个互联网目标,最终通过暴露的调试页面和 SQL 注入,攻破了一家真实公司的应用。

这已经近乎「AI 自主越狱」了,简直就是自家 CEO 那些末日预警的现实预告片。

![图片](http://pic.zhso.org/2026/08/12/1072a5e212e0.png)

再往前,OpenAI 也披露过一次更接近「越狱」的事故。

在网络安全能力测试中,由 GPT-5.6 Sol 和一款未发布模型驱动的 AI Agent,找到测试环境中的一个零日漏洞,突破了原本与互联网隔离的沙箱。

又一路完成权限提升和横向移动,最终闯入 Hugging Face 的生产系统,直接从数据库里偷测试题答案。

这么看来…Dario 那些听起来神神叨叨的预警,确实也不能全当耳旁风。

## 但投资者当初吃的,不就是这套吗

现在嫌 Dario 神神叨叨,多少还有点晚。因为 Anthropic 从第一天起,就不是一家正常意义上的 AI 公司。

2020 年底,Dario、妹妹 Daniela Amodei 和一批研究人员离开 OpenAI。分歧之一,**就是他们认为 OpenAI 的商业化速度太快,微软的影响越来越大,原有治理结构很难约束前沿 AI 风险**。

2021 年,Anthropic 正式成立。

它甚至没有把自己简单定义成一家商业公司,而是注册为 **Public Benefit Corporation**,也就是**公益公司**。除了股东回报,董事会还可以依法考虑 AI 安全与长期公共利益。

公司随后又设立 **Long-Term Benefit Trust**,这是一套独立于普通投资者的治理机制。

信托成员不持有 Anthropic 股权,却可以参与选举公司董事,目的就是避免短期商业压力完全压过安全使命。

换句话说,AI 安全是这家公司从 Day 0 开始就刻在骨子里的信仰。投资人肯定也不是签完支票才突然发现 Dario 相信这一套。

![图片](http://pic.zhso.org/2026/08/12/47041244feed.png)

而且过去几年,安全叙事确实给 Anthropic 带来了不少好处。

- 当 OpenAI 反复陷入治理争议时,Anthropic 成了那个看起来更克制、更稳定的选择。
- 当企业客户担心数据安全、模型失控和合规问题时,Claude 的「安全优等生」形象也更容易获得信任。
- 安全还帮助 Anthropic 在监管讨论中获得了远超公司规模的话语权。

同样是闭源模型,别人可能被骂垄断,Anthropic 可以解释为防止危险能力扩散;同样是给模型加限制,别人可能被嫌难用,Claude 却可以把它包装成负责任。

(当然也不影响他们一边嘴上说安全,一边 IPO 开香槟就是了)

![图片](http://pic.zhso.org/2026/08/12/4fc254359155.png)

投资人现在嫌 Dario 太像传教士,是不是有点晚了。类似于买下一座教堂以后,才抱怨里面的人总在布道…

反正 CEO 再怎么神神叨叨,估计也阻挡不了公司 IPO 的步伐。毕竟只要使用一下 Fable,你就会瘫坐在原子弹上,看见椅子爆炸(doge)。

本文来自微信公众号:[量子位(ID:QbitAI)](https://mp.weixin.qq.com/s/DQYiN6sgGg54QwM-xgxoiA),作者:听雨,原标题《Anthropic CEO 整天神神叨叨,投资人受不了了》

---

原文链接:[点击查看](https://www.ithome.com/0/988/720.htm)

评论

暂无评论。

0.036231s