就目前来说,跑分没输过,小任务还凑合。
代码库里用的静态检测工具有个潜在的bug,导致每次检测cpu利用率飙升到900% + 。 用glm-5.3-flash 也就是牛来模型分析,墨迹了很久没找到根因。 使用GLM-5.2 进行测试,一轮定位问题并且修复。这个回合来说glm-5.2 完胜
附:
glm-5.3-flash
省略部分中间思考步骤……
我没用ds测试过,不知道比ds如何。但是这个模型比上一代旗舰还是有些差距的。编码任务上需要返工,偶尔会丢三落四。
最后,牛来模型我用的是B.ai 的api,glm5.2 用的是catpawAI 也就是袋鼠的AI IDE。