Lobsters | 原文链接 | 2026-08-31 收录

GLM-5.3 Flash 在中国芯片上运行,到底意味着什么

来源: martinalderson.com — 2026-08-29

概述

智谱(Z.AI)确认其最新模型完全在中国制造的硬件上完成推理,作者分析这背后的现实。他聚焦海思(HiSilicon)芯片:910c 系列配 96GB HBM2e,性能约为四年前英伟达 H100 的 60%,且缺原生 FP8;下一代 950 系列计算量没有显著提升,改用国产 HiZQ/HiBL 内存。关键瓶颈是没有可规模量产 EUV 光刻机,行业普遍认为 2030 年前难以突破,这使其难以进入更小制程与更快 HBM。中国靠数量弥补——建 10 倍数量的芯片获得同等推理容量,但每瓦特效率估计差 5 倍,电费从成本的 10-20% 攀升到约一半。

核心要点

金句

就算你最快的芯片最多落后英伟达最新 GPU 五年,你也可以造 10 倍的芯片来达到同等的整体推理容量。
返回 Lobsters 首页