第171章 我需要当面和他谈谈(2/2)
……
然而,震惊过后,朱宋纯的理性开始捕捉到这种算法的缺点。
“不对……这玩意儿,现在的硬件根本跑不动。”
朱宋纯重新坐回椅子上,指关节有节奏地敲击着桌面,大脑开始飞速进行工程评估。
“目前的GPU,无论是英伟达的H100还是国产的昇腾910,其底层架构的设计哲学只有一个——为‘矩阵乘法’极致优化。它们擅长的是大规模、并行的线性运算。”
“但徐辰这个SLRM架构……”
他盯着论文里那些复杂的几何公式:“大量的非线性几何交集运算、复杂的拓扑变换、频繁的条件判断……”
“这在GPU看来,就是最讨厌的‘分支预测’和‘标量计算’。如果强行用CUDA架构跑这个算法,H100的几千个核心大部分时间都会处于‘等待’状态,利用率恐怕连5%都不到!”
“这简直是用法拉利的引擎去拉磨,不仅慢,而且极度浪费!”
“而且,CPU也不行,核心数太少,吞吐量不够。”
朱宋纯叹了口气,眼神中透出一丝无奈。
“工程上是灾难级的。要想产业化,必须重写底层的算子库,甚至……需要专门设计一种新的芯片架构——逻辑处理单元(LPU)。”
“不过,至少从理论上证明了这条路是通的。”
朱宋纯站起身,走到窗前,望着窗外正在建设的计算中心,思绪飘回了七年前。
“2017年,当Transforr架构刚横空出世时,情况比现在好不了多少。那时候,推理一个简单的翻译任务,成本高达每百万token100美元,慢得像蜗牛。”
“后来,产业界花了整整五年。通过FshAttention优化显存读写,通过KVCache加速推理,通过量化技术压缩模型……硬生生把推理成本降到了现在的0.01美元,降幅高达99.99%!”
“正是这无数工程师堆出来的工程奇迹,才造就了ChatGPT的爆发。”
朱宋纯回过头,目光重新落在屏幕上。
“如今,徐辰这个SLRM,就像是当年的Transforr。”
“虽然现在的AI产业链已经比几年前成熟太多,工具链也更完善,要想把这个‘数学模型’打磨成‘商业产品’,速度会快很多。”
“但即便如此,按照正常的市场规律,从芯片设计到流片,从算子优化到框架适配,至少也需要18个月到2年的时间,才能拿出成熟的产品。”
“两年……”
朱宋纯眉头紧锁。
“太久了。在AI这个日新月异的领域,两年足够发生三次技术迭代了。”
但随即,他的眼中闪过一丝决绝的光芒。
“如果……动用国家力量呢?”
“如果我们集中海思、寒武纪的芯片设计能力,集中工程优化团队,集中全国的算力资源,搞一次‘大兵团作战’呢?”
“也许,我们可以把这个时间,压缩到半年!”
“这是一个千载难逢的‘弯道超车’机会。”
“这是一场豪赌。”
“一旦输了,几十亿的投入打水漂。”
“但一旦赢了……”
朱宋纯猛地握紧了拳头,指甲深深陷入掌心。
“我们将彻底摆脱对英伟达CUDA生态的依赖,建立起一套由中国人定义的、全新的AI底层标准!”
“从跟随者,变成领跑者。”
“这个赌注,值得下!必须下!”
想到这里,朱宋纯不再犹豫。
……
他抬起头,目光扫过办公室里的几个博士生。
那种眼神,锐利得让人不敢直视。
“你们几个。”朱宋纯的声音低沉而严肃,“先出去。”
“啊?”博士生们愣了一下。
“把门带上。没有我的允许,谁也不许进来。”朱宋纯加重了语气,“还有,今天你们在这里看到的一切,哪怕是一个标点符号,都不许往外说。听明白了吗?”
“听……听明白了!”
几个博士生吓得一激灵,连忙收拾东西,逃也似地离开了办公室。
走廊里,几个博士生面面相觑,一脸的委屈和茫然。
大家交换了一个眼神,内心疯狂吐槽:
【不是……老板这是受啥刺激了?】
【还“看到的一切,不许往外说”?冤枉啊!我们看啥了?】
【我们就看见您对着个电脑屏幕,一会儿拍桌子狂笑,一会儿站起来转圈,跟练走火入魔了似的……】
【这让我们泄露啥?泄露“震惊!某知名AI大牛疑似更年期综合征发作,办公室独自唱跳RAP”?】
虽然心里吐槽归吐槽,但他们谁也不敢多逗留一秒,赶紧溜之大吉。
……
办公室内,终于清静了。
朱宋纯深吸了一口气,颤抖着手,拿起了桌上的电话,直接拨通了张伟平的号码。
“喂,老张!你那个学生……徐辰!他现在在哪儿?!”
“老张,你赶紧联系他,让他如果有空的话,务必来我办公室一趟!”
“有些事,我需要当面和他谈谈!”