睿闻联播
26-01-29 20:26 微博认证:动漫博主

从夯到拉睿评LLM写代码

Gemini:Gemini Cli 因其政策我也要给一个大大的夯,基本上完全免费的无限额使用最新模型,并且工具的开放性也很强,最重要的是它不会管你做反代理,你可以拿他做其它模型做不到的事情。如果想用llm做个人使用的工具它就是首选甚至是唯一选

其幻觉处理也还不错,Gemini 3.0最恐怖的是其上下文,阅读大型项目的能力极佳。不过这个优点在深度体验后感觉还是不如Claude code,如果你不一点点检查代码,会有很多大跌眼镜的玩意

缺点在于响应速度太慢,降智严重,高峰期甚至可能几分钟憋不出一句话。不过都免费用了我还说啥呢。

网页版Gemini则拉完了,蠢得令人发昏。并且非常难用,非英语设置的还有各种读不出照片的bug,生成出来的东西你要复制出去都很复杂,且不能随意的重新定位会话,难用到令人恼火,其很多官方提供的工具,就算在你勾选并且提示词的情况下还有很大概率他根本不使用甚至是回答你不认识。而且你的提示词对它约束很小,基本上他不太在意你的意见。个人建议如果你不用AI Studio或者cli那就别用这个模型了

Claude Code:无可争议的夯,大降智时代唯一一个人类。含金量有所见证,也是复审代码工作量最小的一集

我真心建议所有AI生成的代码打上水印,不是说要判别谁用了AI,而是我复审代码时不同AI有不同的审法。

其Agent也是现代最强?不,是史上最强。这就是所有Coding Agent的模板。

缺点是个人限额太小,聊两句就歇逼了,而且近年来限额似乎越来越小。你必须思维清晰才能用它做开发

网页版Claude也很不错,应该是所有网页ai体验中最聪明的,最近出了Cowork,我没怎么体验就不评价了。

ChatGpt:幻觉大到晕厥。我已经基本不用了,就偶尔把它当百度用,或者让它帮我翻译,它最大的好处就是翻译很忠诚,不会给你润色,让我中英对照起来很方便

Codex则有些npc,据说有些人很喜欢,我是完全忍受不了。感觉不如Gemini,而且Codex政策也不好,agent做的也很一般。

Deepseek:没有专门的代码工具,网页写代码体验还不错,上下文太短了。Ds是一个你要了解其特性再进行使用的模型,我很喜欢在找到问题后询问ds,因为他api很便宜,而且注意力,降智方面比claude外其它模型好。因为他和其它商业大模型差别过大,把它直接放在这里对比其实不太公平。

Cursor我没用过,这里就不评价了

发布于 福建