浅谈一下各家的大模型和编程工具

前言

前些日子买个 GPT 5的 plus,还买了一些 AI 中转站 API 额度,再加上最近自己在用 trae 做项目。基本上常用的模型我都体验过了,今天和大家聊天各个大模型和编程工具怎么样。

编程工具

Cursor

仅在大二暑假时用过,当时的模式是编辑器 + 编辑器内部了一个聊天界面,好像支持代码补全。后来就没用过了,本来打算前些日子买一个试试,但计费模型变了,20$ 买 20$ 的 API 额度,纯纯恶心人。

WindSurf

年初的时候用过,还挺好的,值得推荐。

Trae

Trae 是年初的时候出的,基本刚发布我就体验上了,当时我对它的评价是一坨 shit,唯一优点就是免费了。7 月份买了个会员试了下,好了不少,为什么不买 Cursor 呢,因为它贵。Trae 首月只要 3$,以后每月都是 10$,其实算下来还行,毕竟有 600 次的请求数。

但它营销太严重了,CSDN、掘金哪都有的广告,前一阵子推出了 solo 模式,搞饥饿营销跟小米一样,官方喜欢在 X 上贬低竞品,也只有适合我这种穷人用了。

codex

ChatGPT 的编程工具,不用说还是强的,plus 每周用 gpt 5 high 的话能用 8 小时左右,我觉得挺香的,就是支付这一块比较难搞。

Qoder

阿里的 AI 编辑器,自我感觉挺不错的,我一般用它修复一些 Trae 解决不了的 bug,同样的描述 Trae 理解了我的意思但是问题没解决到位,Qoder 的话是理解到位、解决到位,也不怎么返工,关键是免费,这还说啥呢,用就完了,不好的地方就是界面比较简洁吧,功能不像 Cursor 和 Trae 那么丰富、完善,毕竟也是新出不久。

Claude Code

没的说,强到爆炸,就是贵,按量付费,最近母公司还爆出不良新闻,不喜欢。

qwen code

与 Claude Code 一样是个命令行的 AI 工具,基于 Gemini Cli 二开,依旧免费。不过一般我用它不写代码,而是帮我理解项目,比如一些新项目、开源项目啥的,写代码的试过速度比较慢还会断连,不知道现在怎么样。

大模型

Claude 4

强,但是喜欢将事情和项目复杂化,经常是越改越庞大,有点儿喜欢“炫技”,得会调教才行。如果能力没它强,用它的话就感觉很累,因为它总时不按照你的意愿操作。(这里我说的场景是用 Trae 等 AI 编辑器的使用场景来评判的)

GPT 5

强,在 GPT 5 没出来前,我都用的是 Claude 4,现在慢慢转向 GPT 5 了,它给我的评价就是稳、细、不怎么返工,缺点就是慢吧,无论是在 Trae 上还是官网用都是这样,毕竟推理花了不少时间。怎么说呢,有点儿指哪打哪的感觉,不会过度地将项目复杂化,而且改动代码很准确,很细,给方案像是架构师,写代码像是外科医生一样稳。不过写前端样式的话还是 cladue 强,不过 claude 写后端属实难评。

Deepseek V3.1

“预期越高,失望越大”。刚更新时我就迫不及待体验了一下,给我的第一感觉就是幻觉严重,还答非所问,包括现在有时候也会。之前让它给我一个技术解决方案,吭哧吭哧给我生成一个网页来,用网页的方式来介绍方案是吧,真的是演都不演了。

最关键的一点儿是生成内容会脏数据,比如生成一些“极”等文字,在 Trae 上用的时候还比较正常,可能是 prompt 引导得好再加上微调了吧。用阿里云百炼调 API 又出现了这个问题,导致我项目用它生成一些结构化数据就很蛋疼,气得我直接不用了。

其他

像 kimi k2、glm-4.5 啥的,我感觉水平和 Deepseek V3.1 差不多,至少我感觉是这样的,官方吹得是挺强的,实际没体会出来。对了,glm-4.5 也出了个订阅方案(https://bigmodel.cn/claude-code?utm_source=bigmodel&utm_medium=link&utm_term=cc&utm_campaign=Platform_Ops&_channel_track_key=i8kwCaos),100 一个月感觉还不错,有兴趣的兄弟可以去试试。

image.png

0个评论
点击登录,快来和大家讨论吧~
表情
图片
暂无评论
吃遍全国汉堡
作者分享
GPT发癫了,我也没聊彩票啊
3
可以转战Claude订阅了,GPT发布延迟还被吊着打,甚至不如去订阅国产 AI 聚合套餐
4
Notus 正式发布:我做了一个真正属于自己的 AI 知识库
6
Notus太强了,点赞
3
这篇文章我十分赞同,GPT 给我的感觉就是不够灵性、不够聪明,必须要给明确的目标和指定任务才能干的好,倘若任务十分发散开放就变得十分糖。相比之下 Claude 就非常有灵性,它总是能看透用户意图抓到用户实际需要什么,特别是在做调研类任务时 Claude 显得更强,GPT 总是 get 不到我的点,我让它找啥它才找啥,很难把我提出每个需求串起来去找,这就很难受。好在GPT 6 Astra 好了不少,但是太贵了。 https://chatgpt.com/share/6ab08cbd-982c-83e8-8d49-02d6006e75e8 这个对话就是一个活生生的例子,我想找一个可以查看各家coding agent额度的项目,通过官方OAuth登录进行登录认证,而不是读取auth.json等权限文件,因为我想搬砖到懒猫微服上去。但这个 GPT 气得我没话说,我把所有需求说明白了,它找出个dsh 插件来了https://github.com/lninghaha/dsh-coding-subscription-oauth 最后跟我说没找到,还是我告诉它有个项目能符合我的要求才开始分析(实际我并没让它分析,我只是问他合不合适,分析过程中它还说了如何去搬到懒猫微服,因为 GPT 记忆中知道搬到懒猫微服的前提是什么,其中条件之一必须是web端架构且不依赖于其他任何项目,是一个独立的项目个体,但它还是能找出 dsh 插件来搪塞我)。 更别说其他的工作,比如调整UI、写文案等。X 上有个帖子说的很好,我让 GPT 调整网页的文案或者按钮的位置,比如我希望把登录功能作为单独的页面展示而不是弹窗,它会非常脑残得在登录页面底部写上“登录功能已作为单独页面展示,而不是弹窗”,如果你经历过肯定知道我在说什么。 还有codex的多agent协作非常的垃圾,主agent不信任sub-agent的执行结果,非要自己去验证,导致之前我本来想写一个文章介绍如何进行多agent实战,但它耗了我2个重置机会连第一个阶段都没进行完,一共有6阶段。而且 GPT 的重置就是个骗局,因为不断重置你很难判断一周内套餐实际能用多少的token量,从而官方可以不断的削减使用量,而且因为不断重置模型不断降智,速度也很慢。
8
下载 APP