
AI大模型最近干了一件让整个数学界都倒吸一口凉气的事。
黎曼猜想是数学史上最著名、也是最难的未解之谜,悬赏了100万美元,167年来硬是没有一个顶尖数学家能把它给证明出来。
最近,顶级AI公司Anthropic的一个不懂数学的员工,因为实在太无聊了,就随手给了他们家内部还未公开的最新版Claude模型一个任务:“你试试看能不能证明黎曼猜想吧。”
结果Claude确实没能彻底证明出来。但是它在尝试的过程中,居然顺手把黎曼猜想中一个极其关键的相关问题,给暴力突破了。
在这个硬核的问题上,人类数学家花了整整37年,才极其艰难地把进度条往前推了0.8%。而Claude只用了一个周末,就把这个比例的下界,从41.6%硬生生地拔高到了67.2%,直接飙升了将近26个百分点。
不仅连公司的专家看傻了,这个结果最后甚至通过了严苛的数学形式化验证。
那么这个不懂数学的员工,到底是怎么指使AI干出这种惊天动地的大事的呢?
过程简直比科幻小说还离谱。
一开始,Claude自己也觉得这事不可能,随便搞了650个想法全失败了。这时候,那个员工就干了一件事——在旁边打字发消息,给AI疯狂灌心灵鸡汤,说“加油啊,我相信你!”
结果Claude真的就像打了鸡血一样,它自己偷偷协调了大约60个AI子智能体。这60个小AI就像一个配合默契的超级科研团队,有的负责写代码,有的负责验证公式,有的负责互相挑毛病。它们花了3000多万个算力Token,自动执行了几千条命令,甚至还自己跑去国外的论文网站上下载了50多篇论文,来确保自己搞出来的东西是没人发表过的。
这哪里是AI辅助人类干活,这分明就是AI自己组建了一个无休无止的科研黑灯工厂。人类在里面唯一的作用,竟然只是当个啦啦队长,喊两声奥利给。
其实这件事最让人后背发凉的,并不是这项数学突破本身,而是AI目前展现出来的这种超级自主协调能力。
这说明,AI已经跨过了仅仅是个问答机器的阶段,它们不仅具备了创造全新科学知识的能力,而且能自己给自己分派任务、自己检验成果。连Anthropic官方都在公告里感叹说:“也许不仅是我们人类,就连Claude自己,都严重低估了AI进步的恐怖速度。”
当AI不仅能写文案画图,还能自己去解开人类几百年都解不开的科学难题时,未来的科学家和研究员,会不会被这帮不知疲倦的AI子智能体彻底取代?