RANKING / 第三方榜单
模型榜单
数据来源:Artificial Analysis · 通道 page_parse · 批次时间 · 共 656 个模型 · 其中 44 条同时有分值与价格(可进斩杀线图)
BY DIMENSION / 按维度
编程与工程 榜
代码评测与终端任务(scicode / terminalBench) · 价格为美元 / 百万 tokens(第三方原始口径)
| # | 模型 | 编程与工程 (代码评测与终端任务(scicode / terminalBench)) | 综合分 | 较上批 | 输入价 | 输出价 | 吞吐 | |
|---|---|---|---|---|---|---|---|---|
| 46 | GPT-5.4 (xhigh) OpenAI · 档案:GPT-5.4 本批新增 推理档位 | 78.3 | 38.98 | — | ¥16.78 | ¥100.65 | 147.9735 | 1050K |
| 152 | Claude Sonnet 5 (Non-reasoning, High Effort) Anthropic · 档案:Claude Sonnet 5 本批新增 | 75.3 | 23.20 | — | ¥13.42 | ¥67.1 | 65.0824 | 1000K |
| 75 | Motif 3 (Beta) Motif Technologies · 档案:Motif 3 本批新增 推理档位 | 70.8 | 32.31 | — | — | — | — | 262K |
| 175 | KAT Coder Pro V2 KwaiKAT 本批新增 | 70.0 | 21.70 | — | ¥2.01 | ¥8.05 | — | 256K |
| 40 | Gemini 3.7 Flash (medium) Google · 档案:Gemini 3.7 Flash 本批新增 推理档位 | 69.1 | 39.62 | — | ¥5.03 | ¥25.16 | 317.8079 | 1000K |
| 2 | Claude Fable 5.1 (Adaptive Reasoning, Xhigh Effort, Default Fallback) Anthropic · 档案:Claude Fable 5.1 本批新增 推理档位 | 69.0 | 53.20 | — | ¥67.1 | ¥335.51 | 61.8045 | 1000K |
| 1 | Claude Fable 5.1 (Adaptive Reasoning, Max Effort, Default Fallback) Anthropic · 档案:Claude Fable 5.1 本批新增 推理档位 | 68.8 | 53.35 | — | ¥67.1 | ¥335.51 | 65.8181 | 1000K |
| 4 | GPT-6 Astra (xhigh) OpenAI · 档案:GPT-6 Astra 本批新增 推理档位 | 68.1 | 52.39 | — | ¥67.1 | ¥335.51 | 54.8871 | 1000K |
| 3 | GPT-6 Astra (max) OpenAI · 档案:GPT-6 Astra 本批新增 推理档位 | 68.0 | 52.67 | — | ¥67.1 | ¥335.51 | 65.2837 | 1000K |
| 53 | Gemini 3.7 Flash (low) Google · 档案:Gemini 3.7 Flash 本批新增 推理档位 | 67.7 | 36.95 | — | ¥5.03 | ¥25.16 | 318.0352 | 1000K |
| 5 | Claude Fable 5.1 (Adaptive Reasoning, High Effort, Default Fallback) Anthropic · 档案:Claude Fable 5.1 本批新增 推理档位 | 66.9 | 51.15 | — | ¥67.1 | ¥335.51 | 55.7654 | 1000K |
| 6 | GPT-6 Astra (high) OpenAI · 档案:GPT-6 Astra 本批新增 推理档位 | 66.5 | 50.92 | — | ¥67.1 | ¥335.51 | 54.4358 | 1000K |
| 81 | GPT-5.5 (low) OpenAI · 档案:GPT-5.5 本批新增 推理档位 | 65.5 | 30.71 | — | ¥33.55 | ¥201.31 | 91.5852 | 922K |
| 35 | Claude Opus 4.7 (Adaptive Reasoning, Max Effort) Anthropic · 档案:Claude Opus 4.7 本批新增 推理档位 | 64.9 | 40.69 | — | ¥33.55 | ¥167.76 | 50.2473 | 1000K |
| 7 | Claude Opus 5 (Adaptive Reasoning, Max Effort) Anthropic · 档案:Claude Opus 5 本批新增 推理档位 | 64.8 | 50.78 | — | ¥33.55 | ¥167.76 | 56.4472 | 1000K |
| 86 | DeepSeek V4 Pro 0424 (Reasoning, High Effort) DeepSeek · 档案:DeepSeek V4 Pro 0424 本批新增 推理档位 | 64.8 | 30.11 | — | ¥2.92 | ¥5.84 | 83.5678 | 1000K |
| 10 | GPT-6 Astra (medium) OpenAI · 档案:GPT-6 Astra 本批新增 推理档位 | 64.4 | 49.57 | — | ¥67.1 | ¥335.51 | 53.6062 | 1000K |
| 8 | Claude Opus 5 (Adaptive Reasoning, Xhigh Effort) Anthropic · 档案:Claude Opus 5 本批新增 推理档位 | 63.4 | 49.68 | — | ¥33.55 | ¥167.76 | 54.4 | 1000K |
| 11 | Claude Fable 5.1 (Adaptive Reasoning, Medium Effort, Default Fallback) Anthropic · 档案:Claude Fable 5.1 本批新增 推理档位 | 63.1 | 48.92 | — | ¥67.1 | ¥335.51 | 56.5061 | 1000K |
| 12 | Claude Opus 5 (Adaptive Reasoning, High Effort) Anthropic · 档案:Claude Opus 5 本批新增 推理档位 | 63.0 | 48.12 | — | ¥33.55 | ¥167.76 | 57.3799 | 1000K |
| 9 | Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) Anthropic · 档案:Claude Fable 5 本批新增 推理档位 | 62.7 | 49.63 | — | ¥67.1 | ¥335.51 | 67.872 | 1000K |
| 79 | Muse Spark Meta 本批新增 推理档位 | 62.2 | 31.30 | — | — | — | — | 262K |
| 240 | MiMo-V2-Flash (Non-reasoning) Xiaomi · 档案:MiMo-V2-Flash 本批新增 | 61.8 | 16.05 | — | — | — | — | 256K |
| 23 | GLM-5.3 (max) Zhipu AI · 档案:GLM-5.3 本批新增 推理档位 | 61.6 | 44.78 | — | ¥9.39 | ¥29.52 | 61.0413 | 1000K |
| 108 | Qwen3.6 Plus Alibaba 本批新增 推理档位 | 61.4 | 27.01 | — | ¥3.36 | ¥20.13 | 56.3601 | 1000K |
| 19 | GPT-6 Astra (low) OpenAI · 档案:GPT-6 Astra 本批新增 推理档位 | 61.3 | 45.78 | — | ¥67.1 | ¥335.51 | 53.3243 | 1000K |
| 153 | GPT-5.5 (Non-reasoning) OpenAI · 档案:GPT-5.5 本批新增 | 61.0 | 23.17 | — | ¥33.55 | ¥201.31 | 79.7457 | 922K |
| 96 | GPT-5.6 Sol (Non-reasoning) OpenAI · 档案:GPT-5.6 Sol 本批新增 | 60.9 | 28.33 | — | ¥26.84 | ¥134.2 | 63.8235 | 1000K |
| 15 | Claude Fable 5.1 (Adaptive Reasoning, Low Effort, Default Fallback) Anthropic · 档案:Claude Fable 5.1 本批新增 推理档位 | 60.7 | 46.82 | — | ¥67.1 | ¥335.51 | 55.2372 | 1000K |
| 14 | GPT-5.6 Sol (max) OpenAI · 档案:GPT-5.6 Sol 本批新增 推理档位 | 60.3 | 46.97 | — | ¥26.84 | ¥134.2 | 84.2378 | 1000K |
| 20 | Qwen3.8 Max (0902) Alibaba · 档案:Qwen3.8 Max 本批新增 推理档位 | 59.9 | 45.42 | — | ¥13.42 | ¥40.26 | 39.2448 | 984K |
| 106 | JT-4.1 Flash 236B A21B China Mobile 本批新增 | 59.5 | 27.29 | — | — | — | — | 256K |
| 56 | Agnes 2.5 Pro Beta Sapiens AI 本批新增 推理档位 | 59.3 | 35.24 | — | ¥0.67 | ¥2.01 | — | 1000K |
| 13 | Muse Spark 1.3 (max) Meta · 档案:Muse Spark 1.3 本批新增 推理档位 | 58.8 | 48.09 | — | ¥8.39 | ¥28.52 | 222.1289 | 1000K |
| 70 | Motif 3 Motif Technologies 本批新增 推理档位 | 58.6 | 33.57 | — | — | — | — | 262K |
| 85 | Apodex 1.1 Apodex 本批新增 推理档位 | 57.6 | 30.37 | — | ¥2.01 | ¥20.13 | — | 256K |
| 31 | GPT-5.6 Terra (max) OpenAI · 档案:GPT-5.6 Terra 本批新增 推理档位 | 57.4 | 42.08 | — | ¥13.42 | ¥80.52 | 104.6262 | 1000K |
| 22 | Claude Opus 5 (Adaptive Reasoning, Medium Effort) Anthropic · 档案:Claude Opus 5 本批新增 推理档位 | 57.3 | 44.83 | — | ¥33.55 | ¥167.76 | 57.7063 | 1000K |
| 26 | GPT-5.6 Sol (xhigh) OpenAI · 档案:GPT-5.6 Sol 本批新增 推理档位 | 57.1 | 44.01 | — | ¥26.84 | ¥134.2 | 72.3042 | 1000K |
| 32 | GLM 5.3 Flash Zhipu AI 本批新增 推理档位 | 56.2 | 41.81 | — | ¥1.01 | ¥3.36 | 89.4447 | 1000K |
| 97 | Nex-N2-Pro (based on Qwen3.5-397B-A17B) Nex AGI · 档案:Nex-N2-Pro 本批新增 推理档位 | 55.5 | 28.20 | — | — | — | — | 262K |
| 24 | Grok 4.6 (high) xAI · 档案:Grok 4.6 本批新增 推理档位 | 55.4 | 44.31 | — | ¥13.42 | ¥40.26 | 60.4124 | 500K |
| 30 | GPT-5.6 Sol (high) OpenAI · 档案:GPT-5.6 Sol 本批新增 推理档位 | 55.2 | 42.35 | — | ¥26.84 | ¥134.2 | 71.2031 | 1000K |
| 34 | Gemini 3.8 Flash (high) Google · 档案:Gemini 3.8 Flash 本批新增 推理档位 | 54.6 | 40.93 | — | ¥5.03 | ¥25.16 | 343.5202 | 1000K |
| 38 | Qwen3.8-Flash-Next Alibaba 本批新增 推理档位 | 54.0 | 39.82 | — | ¥1.01 | ¥3.15 | 54.0853 | 256K |
| 21 | Muse Spark 1.3 (xhigh) Meta · 档案:Muse Spark 1.3 本批新增 推理档位 | 53.9 | 45.07 | — | ¥8.39 | ¥28.52 | 260.3535 | 1000K |
| 33 | Claude Opus 4.8 (Adaptive Reasoning, Max Effort) Anthropic · 档案:Claude Opus 4.8 本批新增 推理档位 | 53.6 | 41.79 | — | ¥33.55 | ¥167.76 | 56.6546 | 1000K |
| 39 | Gemini 3.8 Flash (medium) Google · 档案:Gemini 3.8 Flash 本批新增 推理档位 | 52.9 | 39.77 | — | ¥5.03 | ¥25.16 | — | 1000K |
| 44 | GPT-5.6 Sol (medium) OpenAI · 档案:GPT-5.6 Sol 本批新增 推理档位 | 52.7 | 39.24 | — | ¥26.84 | ¥134.2 | 63.6866 | 1000K |
| 25 | Grok 4.6 (xhigh) xAI · 档案:Grok 4.6 本批新增 推理档位 | 52.7 | 44.20 | — | ¥13.42 | ¥40.26 | 58.1876 | 500K |
币种口径:价格已折算为人民币(1 USD = 6.710202 CNY,来源 open.er-api.com · 2026-09-22);原始口径为第三方币种。
同一模型的多个推理档位(max / xhigh / high…)在榜单里是多行;模型档案把它们折叠成一个条目
(取分最高的档位),点进去可以看到该模型的汇总读数。
想比较性价比请看 斩杀线坐标图 ·
本页只展示已验证有效的批次(校验规则见方法学)。
维度口径:编程与工程 —— 代码评测与终端任务(scicode / terminalBench);
复合维度(编程/智能体/知识)由该组内的评测项**取均值**得到(缺项不参与,不按 0 计),
原始维度值可在模型档案页查看。所有维度都来自同一批快照,切换维度不会重新抓取。