资讯

招商银行统一近万张AI加速卡:利用率从35%提至60%+、每百万Token推理成本降低60%

InfoQ中文·2026/9/9 12:07:58🔗 原文

📋总体概括

招商银行将散落在各业务线、总量近万张的AI加速卡统一纳管调度,通过算力池化和统一资源平台盘活闲置算力。改造后GPU利用率从此前的约35%提升至60%以上,每百万Token的推理成本下降60%。这是国内金融机构少有的大规模AI算力治理案例,说明银行在大模型推理时代的核心竞争力正从买卡数量转向算力运营效率,也为同业提供了降本范本。

关键信息

  • 招商银行对全行近万张AI加速卡进行统一纳管与调度,打破各业务条线算力孤岛。
  • GPU利用率从改造前的约35%提升至60%以上,接近翻倍水平。
  • 每百万Token推理成本降低60%,直接压缩大模型应用运营开支。
  • 案例显示金融机构AI竞争焦点正从算力采购规模转向资源运营效率。

🔥犀利点评

这才是大模型落地该有的姿势。多少机构还在比谁的卡多,招行直接算了笔明白账:近万张卡用率35%,等于六成真金白银在机房里睡觉。统一调度后用率破60%、Token成本砍六成,说明AI的护城河不在采购PPT里,而在调度系统和工程能力里。对其他还陶醉于「算力储备」叙事的机构,这是一记响亮的耳光——卡是买来的,效率是练出来的。

本文由本站自动聚合,以下为原始来源:前往 InfoQ中文 阅读全文