资讯
2大关键处仍被卡:国产AI芯片还在追赶3年前的NVIDIA显卡
📋总体概括
快科技9月6日报道,OpenAI的GPT-6 Astra大模型使用10万卡集群训练、仅显卡费用就达60亿美元,凸显算力差距。国产AI芯片方面,华为、寒武纪、壁仞、摩尔线程及百度、阿里、字节、腾讯等均投入研发,但两大核心指标仍有差距:华为昇腾算力约780TFLOPS、带宽780GB/s,带宽超H100但算力不及,整体难以追上3年前的H200(1700TFLOPS、900GB/s)。报道称华为已推出更强的昇腾950,自研高性能内存将带宽提升至4TB/s。
⚡关键信息
- ▸OpenAI GPT-6 Astra是首个用10万卡训练的大模型,仅显卡费用就达60亿美元
- ▸华为昇腾为国产AI芯片最强:算力780TFLOPS、带宽780GB/s,带宽超过H100但算力差距明显
- ▸对比指标为FP16算力与内存带宽,是AI大模型训练与推理的核心性能指标
- ▸国产芯片整体仍难追上3年前的NVIDIA H200:1700TFLOPS算力、900GB/s带宽
- ▸报道提到华为昇腾950已采用自研高性能内存,带宽做到4TB/s
🔥犀利点评
带宽追上、算力卡壳,这是国产AI芯片最真实的画像——单点突破容易上头条,FP16算力才是硬骨头。昇腾950的4TB/s带宽看似惊艳,但训练瓶颈从来不只是带宽,互连、软件栈、集群稳定性才是H200们真正的护城河。一边是别人10万卡的算力碾压,一边是国产还在追3年前的单卡性能,追赶没错,但别再用带宽单项冠军来叙事了。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 驱动之家 阅读全文 →