梁文峰3万字语录传世,三人成虎。
他是一个理工科的人,只在金融量化和AI智能两方面有擅长,但现在眼看着要把梁竖成圣人了。
只看我能看得懂的,梁文峰队算力的看法,还是不错的。
我们现在主要是跟华为有合作。华为他们自己适配,但我们自己会参与这个生态,会深入参与到华为这个里面去。华为的问题还是产能不足。像华为给我们的大概是一万六千张卡的产能,互联网大厂可能是十几万张,我们一万多张,我觉得这个比例也是比较......但这已经可能是华为就这么多产能了。
所以我们也没法指望在华为上面训后面那个更大的模型,或者说训练几百 B 参数激活的模型,有时就有说在今年。但是明年、后年说不定是有机会的。
华为卡适配,我们主要做的工作是把它的高级语言编译器做好,把 TileLang 做好。把
TileLang 做好之后,问题可能就迎刃而解了。这个事情说起来比较复杂,但是我们在
做,做完之后再来解释会清晰比较多。
你可以理解,V3 训练的时候,它用的还是英伟达的卡,但是已经不用英伟达的生态了。
V3 用英伟达的卡,但是没有用英伟达的生态,而是我们先写一个高级编译器叫
TileLang,然后基于 TileLang 的生态来完成其他所有的事情,就已经几乎不依赖英伟达
的生态了。
只要我把这一套东西,把这个过程重新在华为卡上做一遍,那么就完成了。我觉得这里可能是一个历史性的使命,即可以完全扭转之前大家对国产卡生态不好的认知。现在有些天时地利基本上都全了,就差时间。我觉得一年之内,应该会有很多人在上面都有,或者说都明白这问题算是解决了,剩下就是产能的问题。
我对国产算力是比较乐观的。
我觉得在这一点上,英伟达是在掘自己的坟墓。
华为的超节点,华为的 950 超节点,在性能和价格上可以完全平替英伟达的 GB200、GB300。价格肯定要贵,但贵得有限。价格贵百分之五十、百分之一百,贵百分之一百无所谓,贵百分之两百都无所谓。比如贵百分之一百,我觉得已经可以认为在价格上可以平替了。在任务上也是可以平替的,所有 GB300 能做的任务,华为超节点都能做,延时什么都一样。
唯一的代价是,四张华为卡顶一张英伟达的卡,同时落后两年。四张顶一张这个可以理解。
落后两年的意思是,四张华为 950 能顶一张 GB300。落后两年是时间上落后两年。华为 950 超节点是今年 Q3 还是 Q4 的货,英伟达 GB200 是两年前 Q3 的货,差两年。英伟达今年 Q3 可能已经有新一代了。所以我们跟美国在芯片上的差距,我认为生态上以后不会再有差距,但是在芯片上是四倍加两年。
国产芯片产能问题今年、明年、后年都会卡,但五年后一定能解决。
中美AI差距约12到18个月,但国内只用了美国二十分之一的算力。人才根本不缺,差的就是卡。目标是“把差距缩到6个月、3个月”。
公司一半的核心研究员都在标数据——这是现阶段最重要的事。高端数据瓶颈不是钱,是时间。
只说真话的正言君:这跟做自动驾驶的一样,标定数据,纯人工,是最关键的。
DeepSeek“没有组织,就是愿景驱动的”。没有KPI、没有考核。管理分两条线:自上而下的正式项目和自下而上的个人探索——正式工作不超过员工一半时间。一般不太加班,“做研究需要松弛环境,逼太紧没法做研究”。
只说真话的正言君: 这段,作为一个研发,十几年前就看明白了,可惜国内的研发公司不行,加班熔炉华为也是这一个样子,所以注定没什么研究能力。
通信领域是老本行,从手机和智能汽车行业的做法行事,倒退回去也就知道了。
“只要团队稳定、核心人员都在,AGI一定能成,最多晚个一年半载”。员工期权拿够、团队稳住是当前最重要的事。“其他都是可以克制的”。
只说真话的正言君:说明小米等互联网公司挖人还是很伤的,没办法,赚钱要大家一起赚,光梁圣人一个,也不顶球用。
这也就是我说的为什么国内研发不行,制造拉垮,靠一两个海龟留洋派撑不起这么大的技术换代,但研发基础环境烂,所以就永远也不顶球用。
中国AI最终拼的是“系统性便宜”——就跟制造业一样,成本优势是结构性的。
梁圣人这么说,我还是觉得悲哀的。
芯片的代差、时间的代差,叠加的buff。
这还是小米加步枪干革命的作风,不是长久之计,deepseek只能说螺蛳壳里做道场了。
梁不做垄断,也不跟腾讯字节阿里争c端流量,不赚小钱,根本上还是从大A拿钱太容易了。
所以要想国产研发上一层楼,还是给研发们多发钱吧。除此之外,都是屁。
热门跟贴