资讯

2大关键处仍被卡:国产AI芯片还在追赶3年前的NVIDIA显卡

驱动之家·2026/9/6 13:38:00🔗 原文

📋总体概括

OpenAI发布GPT-6 Astra,成为首个使用10万卡训练的大模型,仅显卡费用就达60亿美元,凸显算力差距。国内华为、寒武纪、壁仞等公司均在研发AI芯片,但对比内存带宽与FP16算力两大核心指标,国产最强的华为昇腾达780TFLOPS、780GB/s带宽,带宽超过H100,但算力仍远逊于3年前的NVIDIA H200(1700TFLOPS、900GB/s)。报道称华为已有更强的昇腾950,采用自研高性能内存,带宽达4TB/s。

关键信息

  • OpenAI的GPT-6 Astra是首个用10万卡训练的大模型,仅显卡费用就需60亿美元
  • 国内华为、寒武纪、壁仞、摩尔线程及百度、阿里、字节、腾讯等均投入AI芯片研发
  • 华为昇腾算力达780TFLOPS、带宽780GB/s,带宽超过H100,但算力差距明显
  • 国产AI芯片整体仍难追上3年前的NVIDIA H200:1700TFLOPS算力、900GB/s带宽
  • 报道称华为已有昇腾950,采用自研高性能内存,带宽提升至4TB/s

🔥犀利点评

带宽追上、算力掉队,这个对比很说明问题——内存带宽靠堆料和自研互联尚可突破,但FP16算力背后是制程、架构和生态的全面差距,被卡的不只是芯片,还有先进制程代工。用3年前的H200当标杆本身就有点寒酸,更何况对手已经在造十万卡集群。昇腾950的4TB/s带宽值得期待,但大模型竞赛拼的是系统级算力,单点追赶难改整体落后格局。

本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文