山月知白
26-06-22 22:20 微博认证:投资内容创作者

GLM-5.2 延续国模Coding上界表现

1。【智谱GLM-5.2全量开放,延续Coding领先表现】 

GLM-5.2在Terminal-Bench 2.1上已接近Opus 4.8的85.0和GPT-5.5的84.0;在SWE-bench Pro上仍低于Opus 4.8的69.2,高于GPT-5.5 (58.6)和Gemini 3.1 Pro (54.2);Arena.ai前端网页编程得分1595仅落后于Fable 5 (1654)。各项编程主流测试集得分全球前三,#开源模型第一,#我们看好智谱新一代模型继续成为国产模型前沿智能标杆。 

2。【市场对于大模型ARR增速下降担忧过度】 

6月以来腾讯、微软、Meta、Uber等大厂因为AI预算消耗过快开始精细化管控token用量。我们认为市场对于大模型ARR增速下降担忧过度,此前市场转载较多的Silicon Data的LLM Token Expenditure Index下降,据其官网原文该指数用于衡量全球代表性模型每百万tokens的综合化费率,说明市场对于海外高价模型的使用更加谨慎并提出性价比要求,并不能说明token实际需求下降。GLM-5.2能力强劲且价格相对海外模型更低,公司坚持开源开放路线,看好智谱及国产模型厂商受益大厂管控token预算以及Fable 5禁用带来的用户迁移。 

3。【通过优化推理引擎及组网架构改善Infra】 

据公司官方微信公众号,公司TileRT高性能推理引擎通过简化Host调用各个算子/内核时的信息传递路径,大大提升推理速度;ZCube组网架构驱动GPU平均推理吞吐提升15%、TTFT P99降低40.6%,交换机与光模块Capex减少33%。我们认为公司将凭借推理引擎、组网架构的创新优化AI Infra供给,积极解决时下推理端产能供不应求的问题,有望驱动ARR进一步上行。 

#微博股票[超话]#

发布于 上海