阿里平头哥真武M890跑通2.4万亿参数,国产算力到底什么水平
广告位
728x90 文章顶部广告位
<p>这周有条国产算力的消息值得细说:阿里平头哥的真武M890超节点完成了与通义Qwen3.8(2.4万亿参数)的适配,成为国内首个可稳定运行超两万亿参数基座的训推一体化硬件平台,已经正式上线阿里云百炼。这个消息在国内AI圈没掀起太大水花,因为大家的注意力都被Kimi K3和OpenAI安全事件吸走了。但作为关注国产算力的开发者,我觉得这条新闻的分量不轻。</p><p>先解释一下"2.4万亿参数稳定运行"意味着什么。万亿参数级别的模型,训练和推理对硬件的要求是指数级增长的。光是把模型加载到显存里,就需要几百张高端GPU。以前国内能做到这一点的,基本是靠英伟达的H100、B200这些卡堆出来的。真武M890能跑通Qwen3.8,说明国产硬件在"能跑"这个门槛上已经跨过去了。这是从0到1的事。</p><p>但"能跑"和"好用"是两回事。这块我没有拿到真武M890的详细性能数据,所以不好下结论。从公开信息看,它走的是"超节点"路线,也就是把多颗芯片通过高速互联打包成一个逻辑节点,对外提供统一算力。这种路线的好处是能绕开单芯片制程的限制,用系统工程的方式堆出总算力;难点在于互联带宽和软件栈的成熟度。阿里云百炼上线,说明至少在阿里自己的云上,软件适配已经跑通了。</p><p>国产算力这两年进步确实快,但咱也得清醒。制程上我们受限于先进光刻机,单芯片性能跟英伟达最新一代还有明显差距。AMD这周发布的MI450、英特尔的数据中心AI业务营收大涨59%,说明国际对手也没闲着。国产算力的真正机会在两个地方:一是AI推理这个增量市场,要求没训练那么苛刻,国产卡有性价比优势;二是"国产替代"的政策红利,金融、政务这些领域对自主可控有硬需求。作为开发者,我自己的态度是:技术上保持关注,业务上能用英伟达就用英伟达,但国产方案必须有一个备选,不是为了情怀,是为了供应链安全。这周半导体设备交付周期延长到原来的1.5到2倍,这种不确定性,谁也说不准明天会怎样。</p>
评价 / 评论
登录后才能发表评论
立即登录您已对该文章进行过评价,感谢您的参与!
暂无评论,来发表第一个评价吧!