AI金三啊
26-06-17 11:20 微博认证:AI博主

GLM-5.2 把 coding 拉进长任务时代

我这次测 GLM-5.2,
最开始其实没想测它会不会写代码。
因为写代码这件事,已经有点测腻了。
让模型写一个 Todo App,或者写一个小工具,看起来很直观,但跟真实工作差得挺远。

真实工作里,更多时候是接手一个旧项目。
一堆文件,一堆历史包袱,一堆你不知道为什么存在、但又不能随便删的东西。
你得先读懂它,然后才能动它。

所以这次我想测的其实很简单:
一个 coding 模型,能不能把一个真实项目读进去,并且在后面的连续任务里一直记住前面发生过什么。
刚好 GLM-5.2 在讲 1M 上下文。

我一开始对这个词没太激动。现在很多模型都会标长上下文,但真正喂到后面还能记住前面细节的,其实没几个。

所以我拿它做了一个更接近真实工作的测试。
我选了 Hono。一个做 Edge 的 Web 框架。
100 个文件,28215 行 TypeScript。
我把源码和测试套件都塞进去,
单次输入 23 万 token。
然后连续跑三轮,不清上下文,每一轮都带着前面的完整历史。

#大模型 ##智谱 ##AI编程 ##ClaudeCode #

发布于 山东