RecodeX 重构消息,英伟达CEO黄仁勋披露,GPT-6 Astra训练使用了约10万张以上Grace Blackwell GPU,通过NVLink72组成高速互联集群。他还表示下一批将有40万张GPU上线,但未说明具体型号和归属。

报道对比了中国头部模型公司的算力差距:字节通过马来西亚接入约3.6万张B200,境内主要使用H20和H800;Kimi被曝通过阿里获得约2万张Hopper GPU(型号说法遭阿里否认);DeepSeek未公布V4完整训练硬件,流出的转写稿称5月约有2万张H等效算力,华为提供的950产能约1.6万张,相当于4000张Nvidia B系列。

英伟达新一代Vera Rubin已全面量产,估算训练大型MoE模型所需GPU数量可降至Blackwell的四分之一。公开资料中尚无中国公司披露用10万张同代先进GPU训练单一模型的案例。