机密档案 · 机密档案 · 机密档案CONFIDENTIAL · CONFIDENTIAL
EN
录音时间点 02:44:00

仿真数据,能否超越人类经验?

投资人追问仿真数据能否让模型超越人类经验上限,梁文锋以AlphaGo为例说明可以超越但有上限。

我觉得有两点超越的,比如说围棋,AlphaGo 他下了一手人类从来没有见到过的棋。
梁文锋回应

不需要那么多家,因为现在可能大家觉得做这个事情的利润率非常高,所以一定要自己做。但当他发现这个事情可能没有那么高利润的时候,可能就不做了。最近肯定是没有那么高利润的,我不相信有那么高利润,因为这不符合客观规律。这意味着我们是处在一个阶段上:如果有一个非常高的利润率,这一定不符合客观规律。我们应该是一个合理的利润。所以这是产业的一个现状,我觉得肯定会收敛。

就是大家做大模型的那一部分,其中不要说某一家独占,说“我要拿走全部利润”,这个肯定不行。如果说每一家都只拿合理的利润,那么其实不需要那么多人去做大模型。中国最后有个三四家竞争,竞争就很充分了,价格绝对已经够打价格战了。大模型可能不说两家大公司、两家小公司,可能就已经比较够了。

至于生态上的,我没有什么太多的想法。我们希望能够扶持更多的人,但是我们并没有那么多的精力。我们是有这个意愿,并且不会有利益冲突,但是我们有没有去做是另外一回事。但至少这里边是没有利益冲突的,我们是希望合作共赢的。

首先,我绝对不认为大模型公司可以拿走大部分利润,这个不可能,因为这么多家大模型公司,现在差距不用那么大。差距只有两个东西:一个是时间,一个是成本。所以不至于哪一家有暴利,我觉得不至于有暴利。成本控制得好的人就多赚一点,成本控制得差的人就少赚一点,仅仅此而已。是不是有回答了?第一个问题是不是回答完了?

投资人提问

大家能……你相信以后肯定是有很多人可以……未来其实会……大家数据应用这些的循环迭代……现在可以听到吗?谢谢。

对,感谢您的回答,也非常深刻地理解和尊重您的这种行业里面的生态战略定位。比如说数据这一块,现在公开的数据,相信模型公司都已经可以有渠道获取,这个方法应该都不成问题,只是时间和成本的问题。

那么后续比如说将到真正到 AGI 的时候,有可能大家一个设想或者理想的状态是,模型可以自我迭代、自我学习,就是自己训练自己。那么这一块的话,目前这个数据,您感觉仿真数据是不是可以用起来,还是说真实数据的质量最高?

如果说还是需要来自于真实数据,那会不会是限制这个 AI 的智能还是在人类的过往……这个层面,因为它依赖的是人类真正曾经有过的真实数据?还是说可以突破这个上限,通过模拟数据、仿真数据、创造数据等等的方式,让这个模型能力去超越人类过往的所有真实……

梁文锋回应

我觉得是能超越的。我觉得有两点超越的,比如说围棋,AlphaGo 他下了一手人类从来没有见到过的棋。就是说,他肯定是在一定的范围内超越人类的。

但是他可能也有上限,他可能也是有局限性。但是这个局限性我们现在看不到。我们认为,所以笼统地认为,它是可以基于人类已经有的、我们已经能说出来的知识上,予以超越的。

投资人提问

那这块后续是靠真实数据还是仿真数据?它会 work 吗?

梁文锋回应

不可能就有很多方法。

投资人提问

好的,谢谢。也占用您的时间了,也想继续请教刚才关于 AI Infra 的问题。第二个问题是什么?有点……好了,我简单快速地重复一下。就是想请教,对于 AI Infra 这一块,未来相信算力现在大家都是千亿美元级别地在投入。那么这块的话,有可能我们相信中国人未来在硬件上是使命必达,有一天可能会有高效率的算力,但有可能这个在实践的过程当中,目前还是一个掣肘。

那么未来会不会是两方面向下而行?一方面是模型的能力迭代之后,它其实对于算力从硬算变成巧算,所以单位模型或者任务对算力的要求和消耗会逐步地边际降低。另一方面,比如说硬件像卡的能力提升,会让迭代速度越来越快,单卡效率提升。

那么这个在过程当中是怎么样的一个现象?会不会是说,现在去建了万卡集群,去买了 H200 或者 960,但是过个两三年,它就变成了一个相对没有那么优质的算力,相对又变成了一个陈旧的器件?

梁文锋回应

英伟达的卡基本上你可以按照五年折旧。华为的卡最多按三年折旧吧。华为 950 今年能用还挺好的,明年用我觉得还可以,后面再用我觉得可能就真的太费电了。华为卡生命周期肯定是会短一点,因为它本来就已经比英伟达晚两年了。但是我觉得差距没那么大。

如果说 B200 现在能买到多少,我觉得都划算。假如说对于腾讯来讲,阿里巴巴能买到的话,再看量;如果合理价格能买到,肯定都是划算的。但不是一个算成本的时候,相信买不到。

投资人提问

明白。

梁文锋回应

我们算力落后,这是一个事实。这个事实通过三方面来消解。第一方面是我们承受模型落后,我们只能够用比他们更小的模型,小多少问题就是训练。我们要承受一定的模型落后,以及模型的尺寸更小。这落后有一个好处,落后意味着你有更多的时间,你有一定的技术,然后这样的话你就可以用巧妙的方法

在分章导读版中打开本章 →
本稿由语音识别自动转写并经 AI 整理,未区分说话人,章节标题、摘要与逻辑流程图为编者归纳,用于辅助阅读;个别专有名词与数字可能存在识别误差,请以原录音为准。梁文锋在会中提示部分数字与情况较为敏感,请勿对外传播或录屏分享。