ModelDial Radar

AI Coding 模型实测榜单

比较不同模型和思考档位的实测成绩、耗时与参考费用。

更新于 9月20日 22:2324 个模型/53 个配置正在检查更新…

当前排名

综合榜每个模型只展示最高实测分;展开可查看全部已发布思考深度。

24 个模型/53 个配置
筛选

各模型最高分配置 · 综合分降序

排名模型/最高分配置操作
0195.796.096.095.082m 30s$6.91费用完整
0289.083.091.095.079m 7s$26.15费用完整
0385.691.084.080.085m 42s$0.55费用完整
0481.066.087.095.092m 12s$7.99费用完整
0579.575.080.085.0144m 16s$2.51费用完整
0677.282.073.075.083m 41s$3.07费用完整
0775.960.088.085.0106m 52s$16.33费用完整
0872.565.085.070.0158m 17s$3.28费用完整
0971.564.088.065.036m 59s$0.42费用完整
1069.262.078.070.0157m 11s$1.78费用完整
1169.069.073.065.0218m 41s$1.63费用完整
1169.063.071.075.0139m 1s未提供费用未知
1368.172.076.055.099m 35s$2.91费用完整
1467.165.087.050.0134m 31s$0.42费用完整
1564.254.072.070.070m 58s$0.66费用完整
1664.064.063.065.096m 50s$1.16费用完整
1761.860.086.040.025m 21s≥$0.13部分费用
1857.746.076.055.096m 17s$0.40费用完整
1857.758.075.040.0110m 31s≥$0.08部分费用
2056.757.043.070.088m 43s$0.32费用完整
2056.760.069.040.0133m 3s≥$3.41部分费用
2253.356.078.025.085m 47s$0.32费用完整
2352.459.071.025.029m 57s$0.12费用完整
2451.743.065.050.056m 33s≥$0.62部分费用
01
5 个配置82m 30s$6.91
02
3 个配置79m 7s$26.15
03
85m 42s$0.55
04
3 个配置92m 12s$7.99
05
2 个配置144m 16s$2.51
06
5 个配置83m 41s$3.07
07
3 个配置106m 52s$16.33
08
158m 17s$3.28
09
2 个配置36m 59s$0.42
10
2 个配置157m 11s$1.78
11
218m 41s$1.63
11
139m 1s未提供
13
5 个配置99m 35s$2.91
14
134m 31s$0.42
15
70m 58s$0.66
16
2 个配置96m 50s$1.16
17
25m 21s≥$0.13
18
2 个配置96m 17s$0.40
18
2 个配置110m 31s≥$0.08
20
2 个配置88m 43s$0.32
20
133m 3s≥$3.41
22
5 个配置85m 47s$0.32
23
29m 57s$0.12
24
56m 33s≥$0.62

综合榜展示目前已经确认的结果。费用按公开价格估算,只用来做对比。

怎么看这份榜单

看最新结果,历史成绩同标准再比

后端、前端和知识推理的更新时间可能不同。综合榜使用每一项最新确认的结果;看历史变化时,只比较用同一套题和规则测出来的成绩。

一次掉分,不代表模型真的变差了

一次分数低,可能只是正常波动。只有连续几次都用同一套评测,而且分数一直往下掉,才说明模型可能真的变差了。