资讯

2大关键处仍被卡:国产AI芯片还在追赶3年前的NVIDIA显卡

驱动之家·2026/9/6 13:38:00🔗 原文

📋总体概括

OpenAI发布GPT-6 Astra,首次使用10万卡集群训练,仅显卡费用就高达60亿美元,凸显算力鸿沟。国内华为、寒武纪、壁仞等均在研发AI芯片,但以内存带宽与FP16算力两项核心指标看,最强的华为昇腾达780TFLOPS、780GB/s带宽,带宽超过H100,算力仍落后,整体难以追上3年前的H200(1700TFLOPS、900GB/s)。报道称华为已有更强的昇腾950,采用自研高性能内存,带宽做到4TB/s。

关键信息

  • OpenAI的GPT-6 Astra是首个用10万卡训练的大模型,仅显卡费用约60亿美元
  • 国产AI芯片核心短板集中在内存带宽和FP16算力两项指标上
  • 华为昇腾算力达780TFLOPS、带宽780GB/s,带宽超H100但算力差距明显
  • NVIDIA H200为3年前产品,性能1700TFLOPS、带宽900GB/s,国产芯片仍难追上
  • 报道提及华为已有昇腾950,采用自研高性能内存,带宽达4TB/s

🔥犀利点评

带宽追上了、算力追不上,这个对比恰好暴露国产芯片的死穴:卡脖子从来不只是制程,还有HBM和互联生态。昇腾靠自研内存把带宽拉到4TB/s是硬功夫,但10万卡集群拼的不是单卡参数,是故障率、软件栈和互联效率,这三样没一样能靠发布会解决。60亿美元的算力账单背后,是美元资本+英伟达生态的复利优势,追赶者连入场费都在涨价。

本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文