#DeepSeekV4Pro和Grok4.6谁更强# 最想看代码和Agent能力。
原因很简单,现在让#AI[超话]# 写几段代码已经没什么稀奇的了,真正难的是给它一个完整任务:自己理解需求、拆解步骤、调用工具、写代码、测试、发现Bug,再继续修改。
这时候模型之间的差距就会慢慢出来。
尤其是Vibe Coding越来越普及以后,模型是不是“会写代码”已经不是最关键的问题,能不能连续工作一两个小时,还不把项目搞乱,才更值得看。
所以这次V4 Pro和Grok 4.6的较量,我觉得Agent跑起来以后,可能比单纯看榜单更有意思。
发布于 上海
