之前公司的龙虾用的顶级模型 opus 和 sonnet,但账单很吓人,比人还贵
于是开启了用国产模型降本之路,基本热度很高的模型,我们都做了尝试。
基于我最常用的一个查日志的链路,我来讲下我的体感。
背景:
1. 龙虾里面有很多的 skill
2. 我的查日志的链路做了一个 skill A,但是公共的一个 skill B有些冲突,所以我单独放了一个路径,并在 TOOLS.md 里面做了引用说明
表现:
qwen-3.7-max:看了日志格式,找到了 skill B,结果放进去跑不通,开始想办法,发现了这个日志在阿里云,去下载结果没有找到密钥,最后寻求我的帮助
deepseek-v4pro:不止匹配到了 skill B,甚至还找到了 BCD,但发现都不能解析这个日志,最后说查了记忆,也不知道是怎么解析,需要我提供进一步信息
glm-5.1:实际上它也找到了 skill B 去,然后发现不对,就自行查记忆去了,然后找到了 skill A,就能正确的走后面的流程了,更让人惊喜的是,在经历几次之后,glm-5.1 模型下的龙虾就记住这个事儿,直接去找了 skill A
综上,我的体感是 glm-5.1 最好,怪不得老外也来抢智谱的 coding plan