Claude Opus 5 (max) · 智能 61 · US$2.03/任务 · 速度 55 Token/sClaude Opus 5 (xhigh) · 智能 60 · US$1.56/任务 · 速度 54 Token/sClaude Fable 5 · 智能 60 · US$2.75/任务 · 速度 73 Token/sGPT-5.6 Sol (max) · 智能 59 · US$1.54/任务 · 速度 81 Token/sClaude Opus 5 (high) · 智能 59 · US$1.06/任务 · 速度 55 Token/sGPT-5.6 Sol (xhigh) · 智能 58 · US$0.95/任务 · 速度 82 Token/sKimi K3 · 智能 57 · US$0.72/任务 · 速度 33 Token/sClaude Opus 5 (medium) · 智能 56 · US$0.62/任务 · 速度 53 Token/sGPT-5.6 Sol (high) · 智能 56 · US$0.62/任务 · 速度 78 Token/sClaude Opus 4.8 (max) · 智能 56 · US$1.80/任务 · 速度 56 Token/sGPT-5.6 Terra (max) · 智能 55 · US$0.82/任务 · 速度 137 Token/sGrok 4.5 (high) · 智能 54 · US$0.35/任务 · 速度 60 Token/sGPT-5.6 Sol (medium) · 智能 54 · US$0.41/任务 · 速度 74 Token/sClaude Sonnet 5 (max) · 智能 53 · US$1.53/任务 · 速度 74 Token/sGPT-5.6 Terra (xhigh) · 智能 52 · US$0.48/任务 · 速度 137 Token/sGPT-5.6 Luna (max) · 智能 51 · US$0.28/任务 · 速度 198 Token/sGLM-5.2 (max) · 智能 51 · US$0.32/任务 · 速度 220 Token/sMuse Spark 1.1 (xhigh) · 智能 51 · US$0.26/任务 · 速度 129 Token/sClaude Opus 5 (low) · 智能 51 · US$0.36/任务 · 速度 52 Token/sGemini 3.5 Flash · 智能 50 · US$0.59/任务 · 速度 188 Token/sGemini 3.6 Flash · 智能 50 · US$0.50/任务 · 速度 240 Token/sGPT-5.6 Sol (low) · 智能 49 · US$0.24/任务 · 速度 76 Token/sGPT-5.6 Luna (xhigh) · 智能 49 · US$0.18/任务 · 速度 184 Token/sGPT-5.6 Terra (high) · 智能 49 · US$0.34/任务 · 速度 122 Token/sGemini 3.1 Pro Preview · 智能 46 · US$0.29/任务 · 速度 129 Token/sGPT-5.6 Luna (high) · 智能 46 · US$0.12/任务 · 速度 197 Token/sQwen3.7 Max · 智能 46 · US$1.03/任务 · 速度 202 Token/sGPT-5.6 Terra (medium) · 智能 46 · US$0.18/任务 · 速度 130 Token/sMiniMax-M3 · 智能 44 · US$0.12/任务 · 速度 89 Token/sDeepSeek V4 Pro (max) · 智能 44 · US$0.04/任务 · 速度 73 Token/sDeepSeek V4 Pro (high) · 智能 43 · US$0.04/任务 · 速度 75 Token/sMiMo-V2.5-Pro · 智能 42 · US$0.06/任务 · 速度 71 Token/sClaude Sonnet 5 (Non-reasoning) · 智能 42 · US$0.37/任务 · 速度 62 Token/sHy3 · 智能 41 · US$0.03/任务 · 速度 60 Token/sGPT-5.6 Sol (Non-reasoning) · 智能 41 · US$0.26/任务 · 速度 75 Token/sGPT-5.6 Terra (low) · 智能 40 · US$0.15/任务 · 速度 129 Token/sDeepSeek V4 Flash 0420 · 智能 40 · US$0.02/任务 · 速度 118 Token/sQwen3.6 Plus · 智能 40 · US$0.31/任务 · 速度 52 Token/sQwen3.7 Plus · 智能 39 · US$0.22/任务 · 速度 52 Token/sGPT-5.6 Luna (medium) · 智能 38 · US$0.07/任务 · 速度 196 Token/sNemotron 3 Ultra · 智能 38 · US$0.25/任务 · 速度 200 Token/sDeepSeek V4 Flash 0420 · AA High Effort · 智能 37 · US$0.04/任务 · 速度 暂无公开数据MiMo-V2.5 · 智能 37 · US$0.01/任务 · 速度 69 Token/sQwen3.6 27B · 智能 37 · US$0.27/任务 · 速度 56 Token/sGemini 3.5 Flash-Lite · 智能 36 · US$0.09/任务 · 速度 428 Token/sGPT-5.6 Terra (Non-reasoning) · 智能 34 · US$0.18/任务 · 速度 133 Token/sQwen3.5 397B A17B · 智能 34 · US$0.33/任务 · 速度 70 Token/sGPT-5.6 Luna (low) · 智能 33 · US$0.06/任务 · 速度 174 Token/sQwen3.5 122B A10B · 智能 32 · US$0.24/任务 · 速度 133 Token/sQwen3.6 35B A3B · 智能 32 · US$0.18/任务 · 速度 158 Token/sRing-2.6-1T · 智能 31 · US$0.35/任务 · 速度 126 Token/sQwen3.6 27B · 智能 30 · US$0.36/任务 · 速度 57 Token/sStep 3.7 Flash · 智能 30 · US$0.09/任务 · 速度 405 Token/sMistral Medium 3.5 · 智能 30 · US$0.39/任务 · 速度 104 Token/sClaude 4.5 Haiku · 智能 30 · US$0.24/任务 · 速度 106 Token/sGPT-5.5 Instant (June 2026) · 智能 29 · US$0.54/任务 · 速度 暂无公开数据Qwen3.5 122B A10B · 智能 28 · US$0.18/任务 · 速度 146 Token/sGPT-5.6 Luna (Non-reasoning) · 智能 27 · US$0.08/任务 · 速度 179 Token/sGemini 2.5 Pro · 智能 26 · US$0.20/任务 · 速度 143 Token/sGemma 4 26B A4B · 智能 26 · US$0.03/任务 · 速度 暂无公开数据NVIDIA Nemotron 3 Super · 智能 25 · US$0.21/任务 · 速度 187 Token/sGemini 3.1 Flash-Lite · 智能 25 · US$0.04/任务 · 速度 329 Token/sGrok 4.3 (Non-reasoning) · 智能 25 · US$0.37/任务 · 速度 101 Token/sQwen3.6 35B A3B · 智能 24 · US$0.60/任务 · 速度 200 Token/sQwen3.5 35B A3B · 智能 24 · US$0.23/任务 · 速度 134 Token/sgpt-oss-120b (high) · 智能 24 · US$0.06/任务 · 速度 284 Token/sCommand A+ · 智能 23 · US$0.00/任务 · 速度 203 Token/sGemma 4 31B · 智能 22 · US$0.03/任务 · 速度 73 Token/sNova 2.0 Pro Preview (medium) · 智能 22 · US$0.17/任务 · 速度 117 Token/sQwen3.5 9B · 智能 21 · US$0.22/任务 · 速度 75 Token/sMercury 2 · 智能 21 · US$0.08/任务 · 速度 987 Token/sQwen3 Coder Next · 智能 21 · US$0.33/任务 · 速度 131 Token/sNorth Mini Code · 智能 20 · US$0.00/任务 · 速度 64 Token/sNova 2.0 Pro Preview (low) · 智能 20 · US$0.21/任务 · 速度 121 Token/sMistral Small 4 · 智能 20 · US$0.10/任务 · 速度 163 Token/sDevstral 2 · 智能 19 · US$0.00/任务 · 速度 36 Token/sNova 2.0 Lite (high) · 智能 18 · US$0.25/任务 · 速度 149 Token/sTrinity Large Thinking · 智能 18 · US$0.13/任务 · 速度 166 Token/sMagistral Medium 1.2 · 智能 18 · US$0.75/任务 · 速度 44 Token/sHyperNova 60B 2605 · 智能 18 · US$0.02/任务 · 速度 364 Token/sDevstral Small 2 · 智能 17 · US$0.00/任务 · 速度 34 Token/sQwen3 Next 80B A3B · 智能 17 · US$0.17/任务 · 速度 210 Token/sMistral Large 3 · 智能 16 · US$0.06/任务 · 速度 49 Token/sgpt-oss-120b (low) · 智能 15 · US$0.02/任务 · 速度 295 Token/sgpt-oss-20b (high) · 智能 15 · US$0.02/任务 · 速度 197 Token/sNova 2.0 Pro Preview · 智能 14 · US$0.25/任务 · 速度 109 Token/sLlama 4 Maverick · 智能 14 · US$0.03/任务 · 速度 105 Token/sNVIDIA Nemotron 3 Nano · 智能 14 · US$0.02/任务 · 速度 156 Token/sMagistral Small 1.2 · 智能 11 · US$0.25/任务 · 速度 88 Token/sMinistral 3 14B · 智能 11 · US$0.15/任务 · 速度 62 Token/sLlama 4 Scout · 智能 10 · US$0.01/任务 · 速度 96 Token/sLlama 3.3 70B · 智能 9 · US$0.08/任务 · 速度 85 Token/sMinistral 3 8B · 智能 9 · US$0.18/任务 · 速度 112 Token/sMinistral 3 3B · 智能 6 · US$0.13/任务 · 速度 251 Token/sPhi-4 Mini · 智能 6 · US$0.00/任务 · 速度 45 Token/sKimi K3 (low) · 智能 47 · US$0.24/任务 · 速度 33 Token/sInkling Small · 智能 40 · US$0.07/任务 · 速度 95 Token/sGrok 4.6 (high) · 智能 61 · US$0.84/任务 · 速度 65 Token/sQwen3.8 Max · 智能 58 · US$1.13/任务 · 速度 47 Token/sQwen3.8 2.4T A95B · 智能 58 · US$1.09/任务 · 速度 50 Token/sMuse Spark 1.2 (xhigh) · 智能 57 · US$0.40/任务 · 速度 暂无公开数据Gemini 3.7 Flash (high) · 智能 56 · US$0.40/任务 · 速度 340 Token/sGemini 3.7 Flash (medium) · 智能 53 · US$0.26/任务 · 速度 274 Token/sDeepSeek V4 Pro 0813 (max) · 智能 53 · US$0.25/任务 · 速度 80 Token/sDeepSeek V4 Flash 0731 · 智能 52 · US$0.03/任务 · 速度 120 Token/sGemini 3.7 Flash (low) · 智能 51 · US$0.16/任务 · 速度 253 Token/sSolar Pro 4 · 智能 42 · US$0.22/任务 · 速度 65 Token/sLing 3.0 Flash · 智能 38 · US$0.04/任务 · 速度 382 Token/sMuse Glimmer (high) · 智能 35 · US$0.07/任务 · 速度 99 Token/sLing 3.0 Tiny · 智能 25 · US$0.00/任务 · 速度 203 Token/sNemotron 3.5 Lightning · 智能 24 · US$0.06/任务 · 速度 293 Token/sGLM-5.3 (max) · 智能 59.51 · US$0.68/任务 · 速度 74.0167800748331 Token/s
坐标锁定01 / 06
模型坐标正在建立坐标场
智能
成本 / 任务
输出速度
拖动准星,磁吸最近模型
颜色区分模型厂商
横轴 · 单任务成本US$0.00–2.75,越右越贵
纵轴 · 智能水平 · v4.16–61,越上越强
v4.1 历史参考2026-08-28 快照;不与新版混排,任务成本非当前 API 价格
MODEL MAP / SOURCE SNAPSHOTS目录更新 · 2026-09-19

模型坐标 · AI MODEL DECISION PLATFORM

模型坐标:AI 模型排行榜与 Benchmark 数据

用公开评测、真实任务、成本和速度选择模型;每个数字都保留来源与原始口径。

653个模型已收录
10项公开测评
23个榜单已发布

WHAT IS MODEL COORDINATE

模型坐标是什么?

模型坐标是一个中文 AI Benchmark 聚合与模型选型站。我们把公开评测、真实任务、API 成本和速度放回各自原始口径,不自产一个掩盖差异的综合总分。

Model Leaderboard

智能指数 v4.3 前 10

共收录 653 个模型配置;v4.3 评测矩阵 528 行。本表只比较同版本、非估算且未弃用的智能指数,不混入旧版任务成本。

查看原始来源 ↗
Artificial Analysis 智能指数 v4.3 前 10,按本次公开原始分数排序
#模型机构智能指数 v4.3观测日期
1Claude Fable 5.1 (max with fallback)Anthropic53.372026-09-09
2Claude Fable 5.1 (xhigh with fallback)Anthropic53.182026-09-09
3GPT-6 Astra (max)OpenAI52.812026-09-09
4GPT-6 Astra (xhigh)OpenAI52.512026-09-09
5Claude Fable 5.1 (high with fallback)Anthropic51.212026-09-09
6GPT-6 Astra (high)OpenAI51.052026-09-09
7Claude Opus 5 (max)Anthropic50.702026-09-09
8Claude Fable 5Anthropic49.702026-09-09
9GPT-6 Astra (medium)OpenAI49.672026-09-09
10Claude Opus 5 (xhigh)Anthropic49.652026-09-09

进入模型库,查看全部 653 个模型配置 →

BEGINNER QUESTIONS

小白最常问的模型选择问题

先给一个能直接执行的答案,再解释适用场景、公开证据和限制。

01Claude Opus 5 vs Sonnet 5

复杂编程、疑难调试和长链路 Agent 选 Opus 5;日常开发、批量调用和成本敏感场景选 Sonnet 5。

查看答案和依据 →
02Claude Code 哪个模型最好

当前 Claude Code 复杂任务首选 Opus 5;日常高频开发优先 Sonnet 5,只有追求最高难度任务上限时再比较 Fable 5。

查看答案和依据 →
03Cursor 用什么模型

不想研究模型时直接用 Cursor Auto;复杂 Agent 任务按当前公开 Cursor CLI 快照首选 GPT-5.5(medium),预算优先选 Composer 2.5。

查看答案和依据 →
04国产模型 Coding 能力排行

当前国产 Coding 综合首选 Kimi K3;预算敏感选 DeepSeek V4 Pro;需要开放生态和私有部署时优先看 Qwen Coder 系列。

查看答案和依据 →
05DeepSeek vs Claude 写代码

只选一个做真实工程,优先 Claude;大量生成、预算敏感或国产 API 场景,优先 DeepSeek。复杂重构和长链路 Agent 是 Claude 的优势区。

查看答案和依据 →
06AI 小说写作模型排行

写中文网文可先试 Kimi,文学润色和改稿优先 Claude,长篇设定管理再比较 Gemini;如果只选一个中文创作起点,本站当前建议 Kimi。

查看答案和依据 →
07中文大模型排行榜

中文选型可从 Kimi K3、DeepSeek V4 Flash 和 Qwen 等候选开始;先按任务与预算筛选,再比较同一评测版本、同一推理档位的结果,不能把国产综合排名当作中文能力排名。

查看答案和依据 →

关于数据

如何理解这些公开数据

当前智能指数榜单展示 Artificial Analysis Intelligence Index v4.3 的公开结果, 由 AA-Briefcase、GDPval-AA v2、AutomationBench-AA、Terminal-Bench v4.0、SciCode、AA-Omniscience、GDP.pdf、AA-LCR v1.1、Humanity's Last Exam、CritPt10 项评测组成。 首页能力—成本坐标保留标注日期的 v4.1 历史快照;不同版本的分数不混排,也不能直接相减表示能力变化。

不同模块使用不同评价对象和量纲:模型、Agent、媒体竞技场、Provider 与硬件数据不能直接横向合并。本站没有重新计算、归一化或修改来源分数。

阅读 Artificial Analysis 原始方法论 · 查看 v4.1 历史方法 · 查看按版本分开的评测矩阵