模型能力-成本边界
成本口径
成本范围
多来源能力比较
按同一能力类别展示 BenchLM.ai、DeepSWE、CodexRadar 与 Artificial Analysis 的原始分数。不同基准的任务集和评分口径不同,仅用于观察来源内相对位置。
当前范围
| 模型 | 强度 | pass@1 | 平均成本 | 边界 | 数据源 |
|---|