不做上游:只吃自己最擅长的一块
不做芯片、不做垂直整合,只聚焦一块;多模态是组件而非主线,Scaling远未到上限。
我只要吃一块就好,我只要吃我最擅长那一块。
Tesla、培育……这个事情。假如说你是运营发电厂的,你并不一定需要去造发电机,对不对?发电设备可以是别人造的,只要它的价格合理,你为什么要自己造?
所以,我希望不用去做芯片。我希望能够以合理的价格买到芯片,这样我就不用去做芯片。我觉得这个很有可能是这样的,就是最近英伟达芯片的利润,不见得是可以……虽然……
我们希望只做一块。我觉得 AI 这个事情很大,并不需要我……我只做一块。如果聚焦,并且我认为这里的生意利益已经足够大,就如果是 AI 时代会产生很多家万亿级别的公司,我觉得我们是其中一家。
我们一直做其中一小块,我们是其中一家已经没有什么问题了,并不需要我……我并不是信心勃勃要做地方。我觉得最可能是比较难变,且你真的想做别的话,你还是会有更多的主意,这个会……这是我们的态度。
譬如说,至少在 To B、To C 这两个业务上,目前能看到的,真的想做 To C 闭环的,反而我们做得好;真的想做 To B 闭环的,说不定也没有我们做得好。你想要得越多……
然后还有,To B 这个可以多说几句。To B 业务的上限应该还是需求,在现在这一代 AGI、AI 技术的背景下,To B 的需求应该是有限的。它会快速增长,但并不是一个无穷大的事情,最终还是受制于需求,不是算力。
在当前技术的条件下,收入有多大,最终还是取决于需求。因为你这样想,我十个月就能收回成本,我肯定是如果有去处,我一块买,是因为没有那么多事情。对,需求应该会越来越大,如果随着技术持续有突破,这个需求会越来越大。
多模态布局,我们一直在做。对产品来讲,它很重要;对 C 端用户产品来讲,它很重要。但是对智能的上限,它是一个组件,它不是主线本身。但是它作为一个组件,多模态我们肯定会做,而且我们也在做。我们应该会上相关的模型,就是我们 V4、V4 的后续版本会支持原生的多模态。但是我们对多模态、对智能来讲,它是个组件,我们不把它当作智能本身,它的主线跟搜索一样。
搜索也是一个组件,多模态也可以,我们的理解它也是一个组件。Scaling,我们是信 Scaling,肯定是规模越大,效果越好,能够解锁更多的功能。阻止我们 Scaling 的其实就是算力,并不是我们不想 Scaling,是我们没有那么多的算力去做这个 Scaling。
我们没有触摸到这个上限在哪里。我们训练这么大的模型,并不是因为我觉得这么大的模型就够了,而是我刚好有这么多资源。我是按照我的资源来算,我能够接受、能够训练的模型是多大,是这样算出来的,并不是这个模型就够了。
目前来看,模型收益还是非常明显的。我们还没有机会碰到这个 Scaling 的墙,这离我们还很远。硅谷在说 Scaling 到头的时候,那是对硅谷来说;对中国人来讲,我们离那个还很远,我们根本就没有 Scaling 到那个程度。
这个 Scaling 包括数据的 Scaling、模型规模的 Scaling,然后训练成本。我们离探索这个 Scaling 的上限还比较远,就是没有那么多算力。但我们也会不遗余力地去推进这个 Scaling 的上限。
包括我们融资完之后,我们有更多的算力,可能训练更大的模型。能在越短时间内买到,就越好;如果能半年内全花完,那么这是最好的,实际上做不到。下一代模型的核心能力,我觉得它必须要有持续学习的能力,它才能叫下一代模型。在那之前,我们能做的就是成本,然后效果做得更好,速度做得更快。但是要有大突破,它应该是具备持续学习的。
然后还有一个问题,就是为什么好像我们特别在乎这个模型的计算效率?因为我确实发现,不是所有人都很在乎这个模型的效率。一个商业化公司来讲,没有动力去追求模型的效率,因为模型效率高一点……所以,它没有那么大的动力去追求模型效率要非常高。所以几个创业公司,他们自己并不会……你没有听到他们说低成本是他们追求的东西,因为那个不符合他们的利益。低成本了,你还赚什么钱?低成本了,你就收不到什么钱了。
相反,这是我们愿景的一部分。或者说,我们的愿景,我们的同学在乎这个成本,因为我们的同学都是普通人,他知道用这个都是要花钱的。他能够有这个同理心:别人要花钱来用,那么别人如果便宜一点,别人能够接受的程度会更高。所以我们有很多同学还是希望我们能够把成本做到更低。但是如果你从商业角度讲的话,其实不会这么考虑。从商业来讲……从成本或者从商业角度讲,这不是第一优先级。对于不管是创业公司来讲,还是大公司来讲,这个服务成本根本就不高。但是我觉得我们希望它是比较轻的,我希望它是一个负担得起的,特别是在中国算力紧缺的这样的背景下,是负担得起的,能在国产卡上用的。