参数局PARAM BUREAU

RANKING / 第三方榜单

模型榜单

数据来源:OpenCompass(上海人工智能实验室) · 通道 json_api · 批次时间 · 共 15 个模型 · 其中 0 条同时有分值与价格(可进斩杀线图)

BY DIMENSION / 按维度

综合智能 榜

Artificial Analysis 智能指数 · 价格为美元 / 百万 tokens(第三方原始口径)

来源: Artificial Analysis OpenCompass 司南 LMArena(人类偏好) OpenRouter(真实调用量)
维度: 综合智能 编程与工程 智能体与工具 知识与推理 性价比 速度 延迟
# 模型 综合智能 综合分 较上批 输入价 输出价 吞吐
1 Claude Opus 5 (high) Anthropic · 未匹配本地档案 本批新增 推理档位 83.3 83.30
2 GPT-5.6-Sol (high) OpenAI · 未匹配本地档案 本批新增 推理档位 80.8 80.80
3 GPT-5.5 (high) OpenAI · 未匹配本地档案 本批新增 推理档位 80.6 80.60
4 Qwen3.8-Max Alibaba · 未匹配本地档案 本批新增 80.6 80.60
5 Doubao-Seed-2.1-Pro-260628 (high) ByteDance · 未匹配本地档案 本批新增 推理档位 80.5 80.50
6 Gemini-3.7-Flash Google · 未匹配本地档案 本批新增 80.5 80.50
7 Kimi-K3 (high) Moonshot · 未匹配本地档案 本批新增 推理档位 79.1 79.10
8 Grok-4.6 (high) xAI · 未匹配本地档案 本批新增 推理档位 78.0 78.00
9 DeepSeek-V4-Pro DeepSeek · 未匹配本地档案 本批新增 77.5 77.50
10 Kimi-K2.6 (high) Moonshot · 未匹配本地档案 本批新增 推理档位 75.7 75.70
11 Claude Opus 4.8 (high) Anthropic · 未匹配本地档案 本批新增 推理档位 75.1 75.10
12 GLM-5.3 Zhipu AI · 未匹配本地档案 本批新增 74.4 74.40
13 DeepSeek-V4-Flash DeepSeek · 未匹配本地档案 本批新增 73.7 73.70
14 Hy3-preview (high) Tencent · 未匹配本地档案 本批新增 推理档位 73.6 73.60
15 MiniMax-M3 MiniMax · 未匹配本地档案 本批新增 69.0 69.00

币种口径:价格已折算为人民币(1 USD = 6.710202 CNY,来源 open.er-api.com · 2026-09-22);原始口径为第三方币种。

同一模型的多个推理档位(max / xhigh / high…)在榜单里是多行;模型档案把它们折叠成一个条目 (取分最高的档位),点进去可以看到该模型的汇总读数。 想比较性价比请看 斩杀线坐标图 · 本页只展示已验证有效的批次(校验规则见方法学)。
维度口径:综合智能 —— Artificial Analysis 智能指数; 复合维度(编程/智能体/知识)由该组内的评测项**取均值**得到(缺项不参与,不按 0 计), 原始维度值可在模型档案页查看。所有维度都来自同一批快照,切换维度不会重新抓取。