资讯
韩企 HyperAccel 4nm AI 芯片 Bertha 量产,面向数据中心推理用途
📋总体概括
韩国AI芯片初创公司HyperAccel的数据中心推理加速器Bertha(Bertha 500)宣布在三星4nm节点量产,由SEMIFIVE提供设计服务。该芯片面积500mm²,FP8算力768 TFLOPS,集成256MB片上SRAM,外接128/256GB LPDDR5X(带宽546GB/s),TDP 250W,采用双槽PCIe卡形态。HyperAccel宣称其对标H100可实现2倍吞吐量、19倍成本效益和12倍能效,主打推理场景的高性价比。
⚡关键信息
- ▸HyperAccel Bertha 500 在三星4nm节点量产,定位数据中心推理,由SEMIFIVE提供设计服务
- ▸芯片面积500mm²,FP8算力768 TFLOPS,支持FP16/8/4与INT8/4多种数据格式
- ▸集成256MB片上SRAM,外接128GB或256GB LPDDR5X内存,带宽546GB/s
- ▸TDP 250W,双槽PCIe AIC形态,另有面向端侧的Bertha 100
- ▸官方宣称吞吐量为H100的2倍、成本效益19倍、能效12倍,均系厂商自测数据
🔥犀利点评
19倍成本效益、12倍能效这种宣传数字听听就好——用LPDDR5X对比H100的HBM,靠砍内存带宽换能效,在推理场景或许真能打,但546GB/s的带宽天花板决定了大模型场景上限。真正的考验不在参数表,而在有没有客户敢把生产负载从CUDA生态迁过来。量产≠商用,软件栈和落地订单才是生死线。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 IT之家 阅读全文 →