26 年的额度已经用了三分之二,姑且记录一下 AI 模型的使用感受。
首先值得欣慰的是,我已经不再主力使用 GPT 和 Claude 了。
近期的 Coding Plan 主力是:
xAI SuperGrok 印度区会员(折合人民币约 50 每月)的 Grok 4.6;
Kimi 199 档会员(完全无法拼出那个单词)的 K3;
Google AI Pro(年付一百刀)的 Gemini 3.7 Flash;
火山方舟原价 200 实付 50 元的 Pro 档 Coding Plan 的 DeepSeek V4 Flash。
以上,整体比较拼好饭。
四项合计成本大约是 ChatGPT Pro 5x 正价的一半,钱算是有省到,但使用上的宽裕和省心程度肯定比不上疯狂重置的后者。
接下来简单点评一下:
从 4.5 开始用 Grok 模型,能力不错,干活一把好手,而且一开始速度快量又大,就很喜欢,但是升级到 4.6 后能力提升多少很难说,缓存价格却实打实的翻倍,这档会员的量就完全不够了。
抠搜的用量令人不悦,但 Grok 最近势头相当不错,刚刚下放到 SuperGrok 的 Grok Bot 也整挺好,只要不断我几份成吉思鸡的的续费价格,咱就是忠实粉丝。
Kimi 也是从 K3 才开始严肃使用,Max 能力令人惊喜,审美好前端很强,整体让人很有信任感,堪称小肥波,但价格不便宜,199 会员的额度支撑不了两三天的重度使用,还有个最大的问题是慢,所以我已经习惯省着用,一般杂活另选贤才。
对吃拼好饭的我来说,K3 有点像是 GPT 5.6 Sol 和 Claude Fable 5 的综合平替,甚至我也用它取代 GPT Pro 做一些调研,不差。
题外话,尝试过 K3-256K 和 Max 以外的其他思考强度,感觉不太行。
自从退了 GPT Pro 5x 后,Grok 和 Kimi 这两本来是我预期的主力,然而完全不够用,于是抱着试试的态度捡起 Google 的 Gemini 3.7 Flash,结果大出意料,能力尚可,前端也不错,关键速度快得飞起,还格外的量大管饱,最近仅有一两次用尽全力才能蹬完 5 小时额度,给我的感觉就仿佛上个月初遇 Grok 4.5。虽然偶尔会有发挥不稳定的时候,但还要啥自行车呢?
有点一快遮百笨的意思,希望 Google 保持住良心,然后再接再厉吧!
最后是字节的火山方舟 Coding Plan,这可能是我最想吐槽的了。阴暗想法可能是官方不想让活动用户捡便宜,强一点的模型用量贼少,开源模型上新非常不积极,高峰期还经常断连,管理后台体验一坨。
但就跟我的印度区 SuperGrok 类似,50 块钱一个月大概不能奢求更多吧(其实不然,同期 OpenCode Go 5 刀的首月优惠还更便宜)。
不论如何,这两个多月在火山用了不少 GLM 5.2,算是我的国模初体验,初感惊艳,后续凑合,没有功劳也有苦劳。可是 GLM 5.3 上线都两周了,跟 5.2 一样的参数基座却一直维持着超高抵扣系数,以所谓原价 200 元一月的会员额度,常常一个需求都做不完就限额,多少也是有点离谱了。
好在相比其他开源模型,火山在 DeepSeek 模型的维护上比较积极,额度比较做人,所以这个月他们上了 DeepSeek V4 Flash 正式版(还是晚了好些天)后,成了我的 dv4f 专用 Coding Plan,多少也体验到了蹬不完的感觉。
但感觉这主要是大肥鱼的功劳。
说到这,原本我的打算是火山到期后去开 OpenCode Go,但到时说不定又有变数,边走边看只能是。
总的来说,开源国模这九个月的进展令人欣喜,它们各有不尽如人意的地方,但加起来也称得上管用,于是上半年如胶似漆的御二家基本被我打入冷宫。只有手头几个实在搞不定,才临时用中转站顶一下,而以我的程度,那样的情况实在不多。
重要的是不和反人类的邪恶公司打交道,这种感觉太好了。
至于 Harness,这问题更复杂了,下回再写。
Using AI 2026
Sep 1, 2026 at 11:11:27