GLM 5.3 Flash是国产芯片提供的推理!
为收集广大用户的广泛、专业反馈,我们在正式发布前,以匿名模型Ox-Alpha(中文社区称作牛来)在OpenCode和OpenRouter上进行了大规模测试。Ox-Alpha迅速成为当周最受欢迎的模型,创下双平台调用量新高。
而这些请求流量全部由国产芯片提供算力支持。
与同一硬件上的初始基线相比,端到端服务性能提升了3倍,硬件效率和单token成本已达到与主流英伟达GPU相当的水平。
这证明国产芯片完全可以在大规模场景下高效、经济地支撑前沿模型的推理需求。
发布于 北京
