我最近开始用智谱的 GLM 5.2之后,就把 Cloud Code 升级到了最新版。
升级到最新版以后,我发现如果用 GLM,实际上它还是不会触发自动压缩上下文的功能。
因为我最近也在并行使用 Claude Sonnet,在 Claude 里同时用这两个模型时,对比非常明显:
1. Claude Sonnet:右下角会有一个“Auto Compact”的提示,显示还有多少额度会自动压缩。
2. 其他模型(比如 GLM):右下角只会直接提示“... Left”,显示剩余的 Context 额度和百分比,这种情况下就只能自己手动去触发压缩。
之前我也琢磨过,这种感觉就跟手动挡和自动挡的车似的。用手动挡(手动压缩)时,你得稍微留心一下,去考虑在工作任务和对话轮次的哪个节点开始压缩,才能让模型处于最佳状态。
这其实是个取舍问题。你可能会问,为啥不直接一直用 Claude 模型,不就万事大吉了吗?
我大概出于两个考虑:
1. 公司的 Token 虽然是免费给员工用,而且现在基本上不限量,但我担心的是,如果我只习惯在这些国际大模型上把事情搞定,那未来万一公司不提供 Token 了,或者我不在公司了,我自己用 AI 做事情的时候该怎么办?我必须得有一个在国内可以稳妥使用的模型作为后备。
2. 确实如我之前所说,GLM 已经比较符合我的工作流习惯,和我的工作流契合得挺好了,所以我才一直在坚持使用。
最近零散的想法挺多的,想到哪儿就记到哪儿吧。