模型对比

Kimi K3 与 GLM-5.3 怎么选

后端总分接近时,优先看五题分布和任务强项;小分差本身不能证明稳定领先。

后端与测试

“Kimi K3 / high”在已发布后端成绩中领先 6 分。“GLM-5.3 / high”的完成耗时少 19 分 53 秒。两边均有参考费用可供比较。

已发布后端成绩
发布时间
2026年10月1日 UTC 22:27
评测版本
coding-fast-v4.12
已测配置
2 个实测配置
批次
evaluation-3341cc23aef23a47f4fab68345dda94009162dc5f5a4e631003cf135e06bdbca

这是汇集并保留已有成绩的数据快照,各配置的评测完成时间可能不同。此页得分只对应后端,不是三项加权综合分。

已发布后端结果

指标Kimi K3 / highGLM-5.3 / high
后端配置排名#35#47
后端得分70/10064/100
后端实测时间2026年9月9日 UTC 22:012026年10月1日 UTC 22:22
耗时37 分 56 秒18 分 3 秒
参考费用$0.89$0.46
路由自定义端点自定义端点
契约测试/边界场景16/208/20
反例构造/重试调度15/2014/20
方案审计/对抗场景14/2013/20
状态机/事务回归12/2013/20
测试设计/缓存回归13/2016/20

如何根据结果选择

总分相近时,哪一个更擅长你需要的能力?

先看后端总分和单题成绩,确认能满足任务要求后,再比较耗时。任一方缺少参考费用时,暂时无法比较费用。