#智谱发布GLM5.3Flash#智谱GLM-5.3-Flash正式发布。这个模型有点意思——总参数320B,但每token只激活18B,比前代砍掉近一半。结果呢?AA综合智能指数57分,跟Anthropic最热门的Claude Opus 4.8打平。
定价更狠:每百万tokens输入0.15美元、输出0.50美元,限时折扣后只要0.045美元。算下来,是Opus 4.8价格的四十分之一。
发布前,智谱用Ox-Alpha这个名字匿名测了几天,OpenRouter和OpenCode上都刷了记录。今晚正式认领,权重同步开源。
架构上换了新东西:稀疏注意力加线性注意力混合,长上下文场景下KV缓存直接降了4.4倍。加上流形约束超连接(mHC),Scaling效率继续往上推。国产芯片集群托底,ZCode等平台今晚接入。每天限量一万张体验卡。
发布于 河北
