回响绝不认什么PPT峰值,更别拿2:4结构化那种‘稀疏算力’来糊弄我。”
顾屿清楚这里面的门道。
所谓的“稠密算力”,就是老老实实把矩阵乘法里的每一项都算得清清楚楚,这是没有任何花招的硬实力。
而“稀疏算力”,说白了就是在神经网络计算时,把一些不重要的参数直接当成“0”剪裁掉,跳过不运算。
前世行业里这套“算力数字翻倍”的内卷风气,源头就是英伟达。
老黄搞出的TenSOr COre原生支持2:4结构化稀疏,直接把纸面数据翻了一倍。
后世那些造车新势力,像蔚来、理想、小鹏、极氪甚至沃尔沃,在发布会上动辄吹嘘单颗Orin芯片254TOPS、双颗508TOPS,拿来糊弄外行的全都是这种稀疏峰值算力,而实际的稠密物理算力其实得直接对半砍。
真正在发布会上老老实实标注真实稠密算力、坚决不拿稀疏峰值搞营销的也就是华为的乾坤昇腾系列、比亚迪的自研璇玑架构,以及黑芝麻智能、大疆车载等少数几家硬核厂商。
即便是前世华为的MDC系列硬件本身支持稀疏运算,所有面向车企和消费者的公开参数也一律只用稠密算力,绝不放稀疏翻倍的数字。
这种取巧的加速手段,拿去开发布会当噱头忽悠外行可以,但想要在需要精确微调的“天问”大模型基座训练上玩这种糊弄人的套路,根本行不通。
“硬指标只是第一关。”陆知远按下翻页笔,屏幕跳到第二页。
“第二项,模型兼容性。这是顾董定下的一票否决项。”
顾屿坐直身子:“算力再高,跑不通‘天问’,那就是一堆昂贵的废硅片。这块芯片必须端到端跑通九天实验室全系模型。从15亿参数训到未来的百亿参数,训练收敛不能掉点。最后的验收方式只有一条,把芯片插在雅安算力中心的机架上,用我们的模型实测跑过为准。”
何廷波重重地点了点头:“模型是你们的,没法造假。拿实战当考卷,这很公平。”
“第三项,软件栈。”陆知远继续宣读,
“算子不支持,硬件就是摆设。华为必须向九天开放完整的工具链。尤其是PyTOrCh适配层,九天模型的代码必须做到零改动或极小改动就能跑。此外,算子开放绝不设黑盒,九天必须能自研算子并集成进NPU工具链。”
“你们这是要把底层大门直接给卸了啊!”余大嘴倒吸一口
本章未完,请点击下一页继续阅读!