Writing

2026年7月coding plan评价

目前我订了 4 个 AI 会员:Claude Pro、ChatGPT Plus、Google AI Pro、OpenCode Go。这几个厂商的模型我都有用到实际开发里,对各自的实际使用情况也有一些体会。

Claude Pro

claude usage stats

当初订阅 Claude Pro 就是为了 Fable 5。Fable 5 的实际体验确实不错,非常聪明,给出的方案和落地代码都比较精炼、切中要害,感觉没有什么可指摘的。缺点就是贵:一开始只有 50% 的 week limit 能用于 Fable 5,到后面直接把 Pro plan 的 Fable 使用权限取消了,换成 $100 的 usage credit。这样看 Pro 计划就没有续的必要了。

Opus 5 发布已有半月,一出来在 coding 上超越 Fable 5 和 GPT-5.6 Sol 成为第一(到现在还是第一)。但实际体验一段时间下来,感觉一般(X 上也有很多吐槽)。优点是代码能力确实无可指摘,缺点是实在太慢:

Worked for 20m 44s

随随便便几轮对话,功能没实现多少,一个下午就没了。

Claude 模型我感觉非常有主见,不像 GPT 那样偏好听从安排。Claude 喜欢自己主导对话节奏、安排接下来的行动。这种特点导致如果你一直跟着它的节奏走,很容易功能设计越加越多,陷入过度设计。

另外,之前一直习惯 Cursor、Codex 式的右栏插件开发 UI,习惯了 Claude Code 的 TUI 之后,发现 TUI 还挺方便的。后面用 Hermes 和 Oh My Pi 都能无缝上手。

用量方面,如果只用 Opus 5,一周的用量差不多刚好用完。「+50% weekly limits promo through Aug 19」这个促销没了之后,Pro plan 应该就不太够用了。

ChatGPT Plus

Codex 目前风头正盛,感觉已经盖过 Claude Code 了。主要是 Codex 虽然顶着程序员专属的名字,实际上非常破圈,很多内容工作者和科研人员,看了宣传短视频就来用了。而且 tibo 时不时发福利来个重置。

从实际体验来看,GPT-5.6 Sol 能力确实一如既往地强。但 GPT 系列一直有些毛病:5.4 不说人话,喜欢冒各种互联网黑话;5.5 开始说人话了,工程能力突出,但前端设计能力拉胯;5.6 Sol 后端编程能力更强,前端也能设计出不算丑的页面了。但 high 以上的思考等级回复太慢(和 Opus 5 一样,prompt 5 秒钟,等回复 20 分钟),还有一个特别的毛病:非常喜欢写测试代码。就像小心翼翼害怕犯错一样,经常一个小改动也要写一堆测试逻辑,测试代码比实际功能代码多得多。

用量方面,如果只用 Sol,week limit 可能不到两天就用完了,只能苦哈哈等着 tibo 重置。Luna 现在虽然非常便宜、量大管饱,但次级模型只能通过提高 thinking level 来提高性能,这样回复也挺慢的。

Google AI Pro

这位更是被称为美国版豆包。实际上 2.5 Pro 和 3.0 Pro 时期 Gemini 还是 GOAT,编程能力、设计能力、文本能力都是顶级,但后来突然就拉了。而且 Antigravity 现在也成了路边:里面的 Gemini 3 Pro 和 Flash 在三四月份很长一段时间几乎都是服务不可用状态,让人很怀疑 Google 这么大一家公司的产品能力。后面的事情更离谱:3.5 Pro 从 5 月承诺下月发布,后来跳票到 7 月,现在 8 月了还没见着影子,让人怀疑 Google 的大模型团队究竟在干什么。后面就是一堆 Google 的人跳槽,Jeff Dean 也辞职创业了。还是希望 Gemini 4 能恢复荣光吧。

从实际体验来看,Gemini 3.5 Flash、3.6 Flash 还是不错的:智商在线,速度特别快,用量也够。缺点就是比较懒。

OpenCode Go

DeepSeek V4 Flash 0731 一推出,OpenCode 笑麻了。DeepSeek 性能又强、价格又低,OpenCode 的每日总 token 消耗量在短时间内翻了 3 倍,主要都是 DeepSeek 贡献的。首月 $5(其实可以不停换号一直享受首月价格),就能低成本实现 token 自由。本来 DeepSeek 价格就低,OpenCode 还推出限时 2x 用量,简直像自来水一样 token 随便用了。

opencode usage status

已经很努力在蹬了,用不完,根本用不完,进度条都不带涨的。

而且 OpenCode 可以使用 Luna,配合 Oh My Pi 补齐 DeepSeek 搜索和识图的短板,让能力强、速度快、价格低的 DeepSeek 更香了。更何况 OpenCode 里还可以用 Kimi K3、Grok 4.5、Qwen 3.8 Max,如果有特别的规划或者设计任务,可以让这些模型来执行。

总结

从将近两年的 vibe coding 经验来看,不能只看模型的能力指标,速度其实非常重要。速度决定了开发的迭代频率,能更早发现问题、调整方向;模型响应更快,也能更好地保持开发过程的心流,而不是发一个 prompt 然后玩半天手机。

选择适合自己风格的模型也很重要。Claude 非常主动(有时候到了显得比较傲慢的程度),适合偏好完全让模型把控节奏的人。GPT 感觉比较言听计从,适合喜欢让模型更多充当执行者角色的人。我的风格是比较喜欢和 AI 一起讨论方案,更多的是提问而不是直接命令模型应该干什么——在讨论、提问和回答的过程中,清晰的路径自然而然地浮现了。

目前的 DeepSeek 后端能力、设计能力都不错,有一定的主见,不像 GPT 那样唯唯诺诺,也不像 Claude 那样显得傲慢,而且响应速度快、能及时反馈,搭配现在后起之秀的开源 harness(Pi + Hermes),感觉会是非常适合充当主力模型的选择(好舒服呀)。当然,还是得期待一手 DeepSeek V4 Pro 正式版,以及 Gemini 4。

More