组织架构、发版节奏与"非线性"的 AGI
涉及组织架构调整、两三个月一次的发版节奏,以及AGI渐进但非线性、终将走向具身智能的讨论。
它没有临界点,但是它是非线性的。我们现在比较相信一个叙事是,AI 可以加速 AI 的研究。
我至少觉得,它得能够持续学习吧。国产硬件在这个时间能追上吗?我觉得国产方面可能需要一个几年的时间。国内首先得解决生态的问题,因为生态是一个信心的问题。解决生态的问题,然后再解决产能的问题,我觉得应该是能够逐步解决的。
我不太相信未来五年之后,我们还卡在产能的问题上。现在肯定是卡在产能问题上,今年、明年、后年,我觉得可能都还是卡在产能问题上,但五年之后,我觉得可能不一定,我还是比较乐观的。
然后第二个问题是,思考未来的组织架构,对人员的规划规模。
首先,我们之前的组织架构是非常分散的,因为没有组织架构。但是我们人在进一步扩大之后,这些肯定是需要做出一些改变的。
现在只能说,这里会需要做很多改变,但现在很难一下子全部表达出来。最后应该还是要分不同的部门,应该有些部门是我们需要建立起比较严谨的层级结构的。另外一些部门,可能还是会维持一个比较松散、比较扁平的结构。
随着人员的增加,我们会做这个调整。应该是我们马上就得做这个调整,因为我已经在做这个调整。已经不做这个调整的话,很多事情是没法推进下去的。确实有很多部门,是应该有组织架构的。
然后大家还有问题是,CV 是先于它的哪个版本是吧?
我觉得我们现在,线上发了这个 V4 版本,还是比较粗糙的,然后能力方面还很多都需要时间。
我们一般,对我来讲,一个比较舒适的发版节奏,大概是两三个月发一版。上次发版可能是四月底,那么下次发版可能是六月底,大概是这样子。如果没有意外的话,应该还是会一版比一版好的。
在 50B 激活的这个尺度上面,我感觉最终我们跟现在的这波开源不会有太大差别。就在推理速度跟效果上,我感觉可能就不会有太大的差别。
但是跟它那个大尺寸的模型,就它一个没公开的模型,应该差距还是比较大的。那个差距应该是,我们这个激活参数应该是做不到的,这就肯定得是一个更大尺寸的模型,可能比如说是 150B。
那么 150B,我觉得按照我们现在训练的进度,今年,乐观的是今年年底可以开始去训练,至少是明年四……差距还是比较大的。对,这是跟 Opus 的差距。
你好,我其实有一个问题,就是经常您说到这个 AGI,它实现的过程是一个渐进式的过程,而不是会有一个突变。所以我可以理解,这是一个没有临界点的过程吗?
它没有临界点,但是它是非线性的。我们现在比较相信一个叙事是,AI 可以加速 AI 的研究,AI 可以加速 AI 的研究。就是说,它不是线性的,因为你可以用 AI 来加速你自己的研究,所以它到后面可能是非线性的。
明白。所以当下您的这个,我理解前面的结论可能就是,语言模型继续 scaling 是够的,是足够的,做到这个状态。
只能说语言模型的 scaling,我现在没有看到有上限。我们现在的智力水平,或造成美国的智力水平,都没有看到上限。
明白。因为我非常好奇,就是你说,对美国来讲,800B 激活这个模型,说比它能训练起,但它也用不起来,所以它只能训练出来,它也很难拿出来给大家用了,因为确实有点贵。我之前其实很好奇的一点就是,人类其实拥有语言能力就是近十万年的事情,然后前面可能进化了三十七亿年。但在训练 AI 这个事情上,可能是可以,你说那个顺序是可以反过来的,但最终可能还是会进入到所谓,也不一定叫世界的模型,还是要进入到物理模型或者具身的那部分,是吧?就是在这个上限之后。
对,我觉得具身肯定还是要进入,最终具身。所以对我们公司来讲,自然而言,可能终点都是具身。因为对一个正常人来讲,他的需求并不是电脑,对不对?因为正常的人,他吃喝玩乐、衣食住行,他不需要电脑。
他需要的是,所以他还是需要具身智能来解决具体人力的需求。如果说目标是解决人力需求的话,所以具身我觉得就是绕不过去的。
明白。所以阶段性地讲,假如说到达类似,也不一定是临界点,就是可以自进化、可以比较好的自进化,或者接近这个与 SWE 的这个上升的到那个时间点上,我很好奇会希望这个状态的 AI 落地的第一个让是……
可能跟现在不一样。我们是希望它能够,就是直接假如说没有具身,那么我们对 AGI 的定义,或者我们希望 AGI 能做什么呢?它能帮我迭代下一版模型,能帮我迭代下一版模型一样。然后如果有了具身之后,我们希望它做的也是,让它来迭代下一版的具身,它来做下一版机器人。
我还是很好奇一点,就是因为我看之前 DeepSeek 的采访等等,应该是在一些重要的方向的选择和研究的选择上面,品位和直觉是很重要的,而不是简单的工程优化。那如果之后 AI 可以自进化的话,这个品位、taste、直觉这些东西还重要,或者说重要的会是什么?
AI 现在不缺品位和直觉,它缺的是持续学习的能力。AI 的品位和直觉没有问题。你让它写个文章,它的品位和直觉,我觉得没有什么问题。
前面还有几个问题,我看一下那个问题。我看屏幕上谈了几个问题,但是我这边看不到了。
梁总,我屏幕上留了个问题,我给您再念一下。其实是想请教一下,continuous learning,就是持续学习,您也提到,很多研究员也提到是一个还没解决的研究问题。然后那个 coding agent,尤其是追上 MILES,就是 Scaling 到这个 Opus 水平、MIS 水平是一个比较确定的目标。对于一个还没解决的研究目标和一个比较确定的 Scaling 目标,您认为应该怎么分配研究资源,尤其是研究员这块的人才资源,怎么样才能达到最好的平衡和效果?