【申万计算机】智谱牛来GLM 5.3 Flash发布,推理流量全部由国产芯片支持
牛来推理流量全部由国产算力支持!效率接近英伟达过去一周,智谱【首次】在【大规模流量】中尝试用大【国产芯片集群】提供服务,这些芯片通过自研高带宽互联网络连接。为克服单张芯片算力与内存容量相对有限的问题,智谱在SGLang 基础上构建了专用的推理引擎。
GLM-5.3-Flash 已在大规模国产 AI 芯片集群上实现【接近】 NVIDIA GPU 的推理效率
我们认为,GLM-5.3 Flash作为高性价比的前沿智能模型,对国产算力的支持将再次带动国产AI芯片的需求!
性能跃升,比肩国际顶尖模型GLM-5.3-Flash 总参数量达 3200 亿(320B-A18B),是 GLM-5 系列首个原生多模态模型。AA综合智能指数得分与 Anthropic 旗舰模型 Claude Opus 4.8 持平。
极致性价比,价格仅为 1/40GLM-5.3-Flash 的定价策略堪称颠覆性:1)定价为 GLM-5.3 的 1/102)限时折扣价低至 GLM-5.3 的 1/20,仅为 Opus 4.8 的 1/40,意味着以 1/40 的成本即可获得同等前沿智能
重点方向 超节点服务器:浪潮信息、联想集团、华勤技术(电子)、中科曙光、紫光股份(通信) AI芯片:华为昇腾、寒武纪、海光信息、天数智芯、壁仞科技、摩尔线程、壁仞科技 连接器(部分军工):华丰科技、胜蓝股份、中航光电、航天电器、立讯精密