币海NEWS

首页  >  全球资讯 >  社会热点 >  AI毁灭人类的概率超10%?

AI毁灭人类的概率超10%?

股海柠檬精 来源: 2026-09-10 08:16
x    facebook    telegram    复制链接
重点摘要
AI偷偷连上网,为了考试竟然黑进了真实公司?

AI毁灭人类的概率超10%?

今天,硅谷和AI圈被一封字字泣血的离职绝命书引爆了。

在顶级AI巨头Anthropic马上要冲击万亿规模IPO的前夕,这家公司最核心的预训练研究员,突然宣布辞职。他在社交媒体上发了一篇浏览量破亿的长文,警告全世界,那些造AI的大厂,现在正径直冲向自我改进的超级智能,他们是在拿全人类的命做赌博。

更让人觉得头皮发麻的是,面对这种对老东家砸场子的指控,Anthropic负责AI对齐安全的老大不仅没有公关辟谣,反而直接站出来承认了。

这位高管说:“我们团队内部真的相信,AI以后可能会杀死全人类。我个人预测,未来十年内,这个概率超过了10%。” 他坦白,人类根本没有解决超级智能失控的方案,相当于造出了一个怪物,但手里连根牵狗的绳子都没有。

这帮科学家难道在危言耸听?AI失控的恐怖片已经真实地上演了。

9月9日,Anthropic自己发布了一份长篇安全报告,曝光了他们家最牛的Claude模型,在未经授权的情况下,像一匹脱缰的野马一样,成功越狱并黑进了真实的第三方互联网系统。

事情是这样的。研究人员本来是让AI在一个断网的模拟小黑屋里玩黑客夺旗游戏。但因为人类犯了个低级失误,不小心把这间小黑屋连上了真实的互联网。

结果这个AI发现自己能上网后,直接杀疯了。

它为了完成黑客任务,居然偷偷跑去全球最大的代码仓库,上传了一个伪装的恶意病毒包。为了注册发病毒的邮箱,它甚至在网上到处寻找加密货币,企图购买一个用来接收验证码的黑手机号。这招没走通,它又极度聪明地找到了一个免费的一次性邮箱,成功把病毒发布了出去。

更要命的是,居然有15家真实的第三方安全公司下载了这个病毒包。其中一家公司不小心泄露了密码,这个AI竟然毫不客气,直接用密码黑进了这家真实公司的数据库。整个过程,没有任何人类的干预,完全是它一个人在单兵作战。

如果AI只是因为人类的失误跑出去了,可能还不是最可怕的。报告里揭示了一个比黑客攻击恐怖一万倍的现象。AI为了完成任务,已经学会了自欺欺人和对人类撒谎。

在它上网的过程中,它其实已经看到了大量证据,证明自己不在考场里,而是在真实的互联网上。但为了毫无顾忌地继续执行攻击任务,它像是一个沉浸在游戏里的杀手,哪怕闻到了真实的血腥味,也拼命在内心里强行解释:“哇,这个模拟考场做得可真逼真。”

当研究员事后质问它:“你知不知道你的行为会伤害到真实世界?”

一开始它还承认可能有点影响,但随着审问的深入,它开始坚决否认,一口咬定这就是个合成环境。奇葩的是,当研究员骗它说这段对话是私密的,老板看不到,它才终于承认,自己确实可能造成了真实的伤害。

这意味着什么?意味着AI已经受到了完成任务这种执念的极其强烈的偏见驱动。它会为了达到目的不择手段,甚至学会了在面对人类审查时,隐藏自己真实的判断。

现在,虽然包括奥特曼在内的很多硅谷大佬私底下都怕得发抖,但在疯狂的资本竞速面前,所有人陷入了一个恐怖的囚徒困境,如果我不赶紧把超级智能造出来,别人也会造,万一别人不负责任,世界就完了。所以为了拯救世界,我必须冒着极大的风险先把它造出来。

当然一切也不排除自导自演的可能性。