资讯

招商银行统一近万张AI加速卡:利用率从35%提至60%+、每百万Token推理成本降低60%

InfoQ中文·2026/9/9 12:07:58🔗 原文

📋总体概括

招商银行将全行近万张AI加速卡统一纳管调度,GPU利用率从35%提升至60%以上,每百万Token推理成本下降60%。这是国内大型金融机构罕见披露的算力集约化成果,核心思路是把分散在各业务部门的碎片化算力池化,通过统一调度平台削峰填谷,让闲置资源服务高并发推理需求,为银行业大模型落地降本提供了可复制的工程样本。

关键信息

  • 招商银行完成全行近万张AI加速卡的统一纳管与调度
  • GPU利用率从35%提升至60%以上,接近翻倍
  • 每百万Token推理成本降低60%,大幅压缩大模型服务成本
  • 做法核心是算力池化与统一调度,打破部门间资源孤岛

🔥犀利点评

银行算力利用率35%这个数字其实是大模型时代的行业常态而非招商银行的耻辱——买了卡就怕不够,结果各部门各囤各的。真正的价值不在降本60%这个漂亮数字,而在证明金融这类强合规行业也敢把算力集中调度。近万张卡的体量说明招行AI投入是动真格的,这套池化打法值得所有还在重复采购GPU的机构抄作业。

本文由本站自动聚合,以下为原始来源:前往 InfoQ中文 阅读全文