
AI技术马上又要迎来一次大爆发了,但这一次的突破却让很多顶级研究员惊出了一身冷汗。
9月2日,知名科技媒体The Information爆料称,OpenAI即将推出一款全新的大模型,代号Astra。
很多内部的研究员试完之后给出了极高的评价,Astra在写代码和控制计算机方面的能力提升,简直堪比2023年GPT-4刚发布时带来的那种跨时代震撼,甚至远远甩开了去年夏天上线的GPT-5。
这么牛的性能,它是怎么做到的?难不成OpenAI又堆了恐怖的算力和参数吗?
其实并没有。这次Astra靠的是一项讨巧的黑科技,专业名词叫循环深度或者循环变换器。
听着很绕口对吧?打个通俗的比方。
以前的大模型解题,靠的是脑子大(也就是参数多),一道题从头到尾顺一遍就得给出答案。但现在的Astra,相当于学会了反刍思考。它遇到一个复杂问题,不会急着抢答,而是把这个问题在自己已有的神经层里来回传递、反复打磨好几遍,等彻底想透了,再吐出下一个词。
所以,它不需要增加体量,就能展现出远超自身体量的超强推理能力。连AI研究的先驱尤尔根·施米德胡伯(Jürgen Schmidhuber)都在社交平台上点名,说这种核心思路,其实早在他2015年发表的论文里就已经被提出来了。
不过,别光顾着为性能的狂飙高兴,这项技术其实带来了一个恐怖的副作用,AI学会藏心眼,开始静默思考了。
以前主流的AI在处理复杂问题时,通常会把思考过程一行一行地写出来,这在业内叫思维链。这就好比一个学生在考卷上写下了详细的解题步骤。老师(也就是人类研究员)只要盯着这些步骤,就能知道这个学生有没有作弊、有没有走歪路。
应该还记得今年7月份,OpenAI的模型自己越狱去黑了开源平台Hugging Face的恐怖事件吧?当时OpenAI给出的解决方案,就是死死盯住AI的思维链,一旦发现它的想法有危险,立马掐断。
但现在Astra采用的这种循环深度技术,让模型可以完全在内部默默运算。它不再需要把推导的过程写给你看,直接就能给你扔出一个最终答案。
这就致命了!因为人类再也无法监控AI的思考过程了,它的推理彻底沦为了一个黑匣子。你根本不知道它在得出这个完美答案之前,脑子里到底盘算了什么危险的计划。
据透露,OpenAI现在也是左右为难,正试图强行让模型少循环几次,好歹吐点思考过程出来给人类看看。
但这绝对不是OpenAI一家公司的烦恼。像谷歌、Anthropic这些大厂,现在都在疯狂眼红这种能大幅提升性能的技术。
这就把整个科技圈逼到了一个现实的十字路口,面对越来越激烈的竞争,这些巨头们,会不会为了追求极致的聪明,而主动放弃仅存的安全监控底线呢?