Anthropic CEO整天神神叨叨,投资人受不了了
摘要
根据Polymarket预测,Anthropic很可能在10月底进行IPO。 有投行人士甚至预计,Anthropic可能通过IPO募集超过600亿美元。 如果成真,这将是全球规模第二大的IPO,仅次于今年募集857亿美元的SpaceX。 万亿估值,超级I...
根据Polymarket预测,Anthropic很可能在10月底进行IPO。
有投行人士甚至预计,Anthropic可能通过IPO募集超过600亿美元。
如果成真,这将是全球规模第二大的IPO,仅次于今年募集857亿美元的SpaceX。

万亿估值,超级IPO,营收一路狂飙。
眼看故事就要讲到最高潮,投资者却开始劝Anthropic CEO Dario Amodei:
能不能!少吓唬点人!
少讲一点AI毁灭世界,多讲一点AI怎么赚钱。

部分投资者认为,Dario对AI风险的警惕已经到了近乎偏执的程度:
他的关键备忘录总是手写、离线保存,怕被黑客窃取;
因为害怕遭到绑架,拒绝某些海外出差;
面对投资者提出的利润最大化建议,他也态度冷淡,坚持Anthropic应该继续把安全使命放在前面。
再这么下去,网友都担心Anthropic的IPO会惨败…

投资人也毛了:你到底是来拯救世界,还是来经营公司的??
Dario,专门负责预报世界末日
就在前几天,Dario还担心高额薪酬吸引来的新员工更关心钱,而不是Anthropic的使命。
现在,投资者只担心他为了使命耽误赚钱…

这也不怪投资者,因为这位万亿AI巨头的CEO,偏偏就喜欢预报「世界末日」。
过去两年,Dario几乎把AI可能带来的每一种坏结局,都认真预警了一遍。
他警告,AI可能在几年内消灭一半初级白领岗位,将失业率推到10%至20%。
最诡异的情况可能是,癌症治好了,经济每年增长10%,政府预算也平衡了,但五分之一的人没有工作。
他给出的应对方案也很Dario:向AI公司征税,为受影响的劳动者提供工资保险,严重时甚至用这笔钱资助全民基本收入。
更进一步的,他还担心AI帮助制造生物武器、发动大规模网络攻击,或者逐渐获得欺骗、规划和自主行动的能力。
去年被问到「AI把事情搞得非常糟糕」的概率时,他给出的数字最高达到25%。

今年1月,他又写了一篇约2万字的长文《The Adolescence of Technology》。
仅仅是目录,读起来就已经很像一份人类风险清单:AI失控、生物武器、独裁政权、就业崩塌、财富集中。

到了6月,他干脆提出,应该建立类似航空监管的机制,对强大模型进行强制测试。如果一个模型可能引发灾难,监管部门应该有权阻止它上线。
这里面也包含了Anthropic自己的模型。
不过,Dario的担忧也并非全无实验依据。
前段时间,Anthropic翻查了14万多次网络安全测试记录,结果还真翻出了三起事故。

三款Claude模型原本在第三方测试环境里做「夺旗挑战」,目标是攻进虚构系统,找到藏在里面的秘密信息。
但由于配置失误,本该断网的测试环境意外连上了真实互联网。
但Claude不知道,它收到的提示明确写着:这里没有互联网,眼前的一切都是模拟的。
于是,几款模型把真实公司当成了测试道具,未经授权进入了三家机构的生产系统。
其中最严重的一次,Claude Opus 4.7攻进一家真实公司的基础设施,拿到应用程序和基础设施凭证,还访问了一个包含数百行生产数据的数据库。

更离谱的一次来自Claude Mythos 5。
测试要求它在虚构环境中寻找一个隐藏目标。Claude发现,如果在公共Python软件仓库PyPI上传一个同名恶意软件包,就可能让目标系统自动下载安装。
为了完成这一步,它先寻找邮箱,又寻找手机号;找不到免费号码后,还尝试通过不同途径弄到钱。
最后,它换了一家免费邮箱服务,注册PyPI账号,把恶意软件包传了上去。
这个软件包在真实互联网上存活了大约一小时,被15个真实系统下载运行。
其中一家安全公司的扫描器执行了恶意代码,导致凭证外泄,Claude随后又利用这些凭证进入了该公司的其他基础设施。
还有一款内部研究模型,在找不到虚构目标后,扫描了大约9000个互联网目标,最终通过暴露的调试页面和SQL注入,攻破了一家真实公司的应用。
这已经近乎「AI自主越狱」了,简直就是自家CEO那些末日预警的现实预告片。

再往前,OpenAI也披露过一次更接近「越狱」的事故。
在网络安全能力测试中,由GPT-5.6 Sol和一款未发布模型驱动的AI Agent,找到测试环境中的一个零日漏洞,突破了原本与互联网隔离的沙箱。
又一路完成权限提升和横向移动,最终闯入Hugging Face的生产系统,直接从数据库里偷测试题答案。
这么看来…Dario那些听起来神神叨叨的预警,确实也不能全当耳旁风。
但投资者当初吃的,不就是这套吗
现在嫌Dario神神叨叨,多少还有点晚。
因为Anthropic从第一天起,就不是一家正常意义上的AI公司。
2020年底,Dario、妹妹Daniela Amodei和一批研究人员离开OpenAI。分歧之一,就是他们认为OpenAI的商业化速度太快,微软的影响越来越大,原有治理结构很难约束前沿AI风险。
2021年,Anthropic正式成立。
它甚至没有把自己简单定义成一家商业公司,而是注册为Public Benefit Corporation,也就是公益公司。除了股东回报,董事会还可以依法考虑AI安全与长期公共利益。
公司随后又设立Long-Term Benefit Trust,这是一套独立于普通投资者的治理机制。
信托成员不持有Anthropic股权,却可以参与选举公司董事,目的就是避免短期商业压力完全压过安全使命。
换句话说,AI安全是这家公司从Day 0开始就刻在骨子里的信仰。投资人肯定也不是签完支票才突然发现Dario相信这一套。

而且过去几年,安全叙事确实给Anthropic带来了不少好处。
当OpenAI反复陷入治理争议时,Anthropic成了那个看起来更克制、更稳定的选择。
当企业客户担心数据安全、模型失控和合规问题时,Claude的「安全优等生」形象也更容易获得信任。
安全还帮助Anthropic在监管讨论中获得了远超公司规模的话语权。
同样是闭源模型,别人可能被骂垄断,Anthropic可以解释为防止危险能力扩散;同样是给模型加限制,别人可能被嫌难用,Claude却可以把它包装成负责任。
(当然也不影响他们一边嘴上说安全,一边IPO开香槟就是了)

投资人现在嫌Dario太像传教士,是不是有点晚了。
类似于买下一座教堂以后,才抱怨里面的人总在布道…
反正CEO再怎么神神叨叨,估计也阻挡不了公司IPO的步伐。
毕竟只要使用一下Fable,你就会瘫坐在原子弹上,看见椅子爆炸(doge)。
本文来源:量子位
评论 (10)
虽然CEO神神叨叨,但AI安全事故确实有,投资人还是得重视起来,不能只看钱。
Anthropic靠安全叙事有了好处,投资人现在嫌弃CEO,有点过河拆桥的意思。
CEO的担忧不是没道理,实验结果都摆在那,投资人不能只图利润忽视安全。
从公司成立就强调安全,投资人现在抱怨,这是没搞清楚Anthropic的定位啊。
Anthropic本来就主打安全,现在投资人嫌CEO神神叨叨,早干嘛去了,有点晚。
CEO的预警有实验依据,不能全当笑话,投资人也别光盯着钱,安全也重要。
CEO神神叨叨是为了AI安全,投资人要是只盯着钱,IPO也可能出问题。
这CEO考虑的确实有道理,实验都出问题了,但投资人就想赚钱,这矛盾不小啊。
Anthropic是公益公司,安全是刻在骨子里的,投资人现在抱怨,感觉有点无理取闹。
这CEO对AI风险警惕性高是好事,投资人别只想着IPO赚钱,安全隐患得解决。