跳到正文
评测来源

Artificial Analysis Intelligence Index

Artificial Analysis · 把多项当前评测放到同一套环境里复跑,得到一个综合能力分。价格只作参考,不进总分。

官方评测
在 KuakeAI 中参与排名
证据预算30%
上游数据时间待核实
最近成功同步10/03 16:22

它测什么,怎么测

只取官方 Artificial Analysis Intelligence Index;接口中的性能与价格字段不计分。

如何使用这份证据

综合任务证据占 30%;已核对 v4.3 的 10 项底层评测,与现役专项没有重复计票。整项保留,不将聚合分冒充单项成绩。

评测成绩

按固定规则,每个公开模型采用一套代表配置;没有可采用配置的模型标为未计入并写明原因。匿名测试型号不展示,保留原榜名次,每项最多 30 个。

原榜名次原榜型号原始成绩代表配置
1claude-opus-5-5Anthropic57.6Max 推理 · 含来源回退未计入:混合模型或回退配置,不能代表单个模型的能力。
2claude-sonnet-5-5Anthropic56Max 推理 · 含来源回退未计入:混合模型或回退配置,不能代表单个模型的能力。
5claude-fable-5-1Anthropic53.4Max 推理 · 含来源回退未计入:混合模型或回退配置,不能代表单个模型的能力。
7gpt-6-astraOpenAI52.7Max 推理
8gemini-4-argonGoogle52.6High 推理
11gpt-6-1-solOpenAI51.8Max 推理
16claude-opus-5Anthropic50.8Max 推理
19claude-fable-5Anthropic49.6Max 推理 · 含来源回退未计入:混合模型或回退配置,不能代表单个模型的能力。
22muse-spark-1-3Meta48.1Max 推理
25gpt-6-solOpenAI47.6Max 推理
26gpt-5-6-solOpenAI47Max 推理
29grok-4-7xAI46.4xHigh 推理
30mimo-v2-6-proXiaomi46.3来源默认配置
33qwen3-8-maxAlibaba45.4来源默认配置
35glm-5-3Z.ai44.8Max 推理
38grok-4-6-xhighxAI44.2xHigh 推理
41step-5StepFun43.7来源默认配置
42kimi-k3Moonshot AI43.6Max 推理
48gpt-5-6-terraOpenAI42.1Max 推理
50claude-opus-4-8Anthropic41.8Max 推理
50glm-5-3-flashZ.ai41.8来源默认配置
52gemini-3-8-flashGoogle40.9High 推理
54claude-opus-4-7Anthropic40.7Max 推理
56qwen3-8-2-4t-a95bAlibaba39.9来源默认配置
57qwen3-8-flash-nextAlibaba39.8来源默认配置
60muse-spark-1-2Meta39.6xHigh 推理
62deepseek-v4-1-flashDeepSeek39.5Max 推理
65gemini-3-7-flashGoogle39.1High 推理
66gpt-5-4OpenAI39xHigh 推理
67grok-4-5xAI38.8High 推理
评测局限与数据署名

缺少 API key 时整张来源退出本轮,不补 50 分;严禁用网页抓取替代,展示时必须署名并保留指数版本。

数据许可:API 数据展示或分享须显著署名;再分发权与定制条款须另行取得并遵守 Terms of Use

成绩由 Artificial Analysis 发布,原始分数与 KuakeAI 共识分使用不同尺度,不能直接相加。