7月23日消息,DeepSeek创始人梁文锋近期一场投资人交流会的录音文字稿在业内流传。
关于中美在AI方面的差距,梁文锋表示:”落后美国一到两年,但只用美国二十分之一的算力把这个事情做出来。"未来的目标是把时间差缩到6个月、3个月,甚至在某些重点领域实现超越。但他同时保持克制:在总体算力存在数量级差距的情况下,"全面超越是不现实的"。
梁文锋直言,DeepSeek跟美国的差距只有一点,就是资源。
他算了一笔账:如果要训练跟美国同样大的模型,需要五万张GB300,或者二十万张华为950,"这只是训练,还没有考虑做研究"。而DeepSeek即便把500亿融资全部花掉,也训不起、用不起这个级别的模型。因此当前的策略是在几十B激活的规模上先把它做好,等资源到位后再向150B、250B激活的规模推进。他透露,150B模型乐观的话今年年底可以开始训练。
在梁文锋看来,人才上中美几乎没有差距,"人才不是瓶颈,资源是最大的瓶颈",甚至连人才差距本质上也是算力差距造成的,算力少,能做的实验机会就少。
梁文锋透露,DeepSeek目前大概拥有两万张H等效算力,其中大部分是最近一两个月刚到货,"可能还有很多机器还没有来",接下来几个月还会有大批量机器买入,基本上都是英伟达。
采购策略上,他的表述相当激进:"在合理的价格里面,能买到多少卡就买多少卡。"他甚至表示,如果半年之内就把融资的钱花完,"这太幸福了,这太理想了"——把钱变成英伟达卡肯定比放在银行里好,公司也愿意为此支付一定的溢价。不过他也坦言,要把这么多钱花完非常不容易,"买不到那么多卡,很难买,而且价格也很高"。他给出一个量化标准:如果今年能够花掉两百亿,"就属于我们的采购部门业绩超级好了"。