先看 Intelligence Index 及其组成评测,再进入模型详情核对强弱项。
Models
模型库
横向比较模型的 Intelligence Index、上下文窗口、单任务成本、生成速度、首字等待和完整响应时间。数据保持原始口径。
HOW TO RANK
没有唯一总榜:先按任务选择指标
本页不把能力、价格、速度和中文表现合成为本站总分。选择一个真实任务,再在同一来源、同一单位和同一快照内比较。
查看 Coding Agent 的具体 Harness、任务得分、成本和执行时间。
查看中文模型选择与固定样本中文测评,不用英文总榜替代中文体验。
同时比较成本、速度与延迟,并确认实际 Provider 和模型版本。
FULL RANKING
AI 模型完整排行榜与性能对比
可按模型、机构与状态筛选,并对智能指数、上下文、单任务成本、生成速度和响应时间分别排序。
| 模型 | 上下文 | 机构 | USD | Token/s | 秒 | 秒 | 进一步分析 | |
|---|---|---|---|---|---|---|---|---|
| Claude Opus 5 (max)推理模型 | 1M | Anthropic | 61 | US$2.03 | 55 | 80.01 | 89.14 | 详情Provider ↗ |
| Grok 4.6 (high)推理模型 | 500k | SpaceXAI | 61 | US$0.84 | 65 | 39.57 | 47.21 | 详情Provider ↗ |
| Claude Opus 5 (xhigh)推理模型 | 1M | Anthropic | 60 | US$1.56 | 54 | 42.93 | 52.21 | 详情Provider ↗ |
| Claude Fable 5推理模型 | 1M | Anthropic | 60 | US$2.75 | 73 | 197.59 | 204.43 | 详情Provider ↗ |
| GLM-5.3 (max)推理模型 | 1M | Z AI | 59.51 | US$0.68 | 74.017 | 2.053 | 35.829 | 详情Provider ↗ |
| GPT-5.6 Sol (max)推理模型 | 1M | OpenAI | 59 | US$1.54 | 81 | 144.31 | 150.51 | 详情Provider ↗ |
| Claude Opus 5 (high)推理模型 | 1M | Anthropic | 59 | US$1.06 | 55 | 20.9 | 30.02 | 详情Provider ↗ |
| GPT-5.6 Sol (xhigh)推理模型 | 1M | OpenAI | 58 | US$0.95 | 82 | 38.11 | 44.23 | 详情Provider ↗ |
| Qwen3.8 Max推理模型 | 1M | Alibaba | 58 | US$1.13 | 47 | 2.63 | 55.65 | 详情Provider ↗ |
| Qwen3.8 2.4T A95B推理模型 | 984k | Alibaba | 58 | US$1.09 | 50 | 2.75 | 52.65 | 详情Provider ↗ |
| Kimi K3推理模型 | 1.05M | Kimi | 57 | US$0.72 | 33 | 144.34 | 219.46 | 详情Provider ↗ |
| Muse Spark 1.2 (xhigh)推理模型 | 1.05M | Meta | 57 | US$0.40 | — | — | — | 详情Provider ↗ |
| Claude Opus 5 (medium)推理模型 | 1M | Anthropic | 56 | US$0.62 | 53 | 5.78 | 15.25 | 详情Provider ↗ |
| GPT-5.6 Sol (high)推理模型 | 1M | OpenAI | 56 | US$0.62 | 78 | 12.48 | 18.92 | 详情Provider ↗ |
| Claude Opus 4.8 (max)推理模型 | 1M | Anthropic | 56 | US$1.80 | 56 | 30.95 | 39.81 | 详情Provider ↗ |
| Gemini 3.7 Flash (high)推理模型 | 1M | 56 | US$0.40 | 340 | 9.83 | 11.3 | 详情Provider ↗ | |
| GPT-5.6 Terra (max)推理模型 | 1M | OpenAI | 55 | US$0.82 | 137 | 177.83 | 181.47 | 详情Provider ↗ |
| Grok 4.5 (high)推理模型 | 500k | SpaceXAI | 54 | US$0.35 | 60 | 9.76 | 18.04 | 详情Provider ↗ |
| GPT-5.6 Sol (medium)推理模型 | 1M | OpenAI | 54 | US$0.41 | 74 | 4.48 | 11.23 | 详情Provider ↗ |
| Claude Sonnet 5 (max)推理模型 | 1M | Anthropic | 53 | US$1.53 | 74 | 161 | 167.79 | 详情Provider ↗ |
| Gemini 3.7 Flash (medium)推理模型 | 1M | 53 | US$0.26 | 274 | 4.22 | 6.05 | 详情Provider ↗ | |
| DeepSeek V4 Pro 0813 (max)推理模型 | 1M | DeepSeek | 53 | US$0.25 | 80 | 1.82 | 33.07 | 详情Provider ↗ |
| Qwen3.8 27B推理模型 | 256k | Alibaba | 52.02 | — | — | — | — | 详情Provider ↗ |
| GPT-5.6 Terra (xhigh)推理模型 | 1M | OpenAI | 52 | US$0.48 | 137 | 21.66 | 25.32 | 详情Provider ↗ |
| DeepSeek V4 Flash 0731推理模型 | 1M | DeepSeek | 52 | US$0.03 | 120 | 1.43 | 22.27 | 详情Provider ↗ |
| GPT-5.6 Luna (max)推理模型 | 1M | OpenAI | 51 | US$0.28 | 198 | 139.79 | 142.31 | 详情Provider ↗ |
| GLM-5.2 (max)推理模型 | 1M | Z AI | 51 | US$0.32 | 220 | 1.32 | 12.7 | 详情Provider ↗ |
| Muse Spark 1.1 (xhigh)推理模型 | 1.05M | Meta | 51 | US$0.26 | 129 | 1.46 | 20.88 | 详情Provider ↗ |
| Claude Opus 5 (low)推理模型 | 1M | Anthropic | 51 | US$0.36 | 52 | 2.98 | 12.68 | 详情Provider ↗ |
| Gemini 3.7 Flash (low)推理模型 | 1M | 51 | US$0.16 | 253 | 0.74 | 2.71 | 详情Provider ↗ | |
| Gemini 3.5 Flash推理模型 | 1M | 50 | US$0.59 | 188 | 24.88 | 27.54 | 详情Provider ↗ | |
| Gemini 3.6 Flash推理模型 | 1M | 50 | US$0.50 | 240 | 18.38 | 20.46 | 详情Provider ↗ | |
| GPT-5.6 Sol (low)推理模型 | 1M | OpenAI | 49 | US$0.24 | 76 | 3.09 | 9.7 | 详情Provider ↗ |
| GPT-5.6 Luna (xhigh)推理模型 | 1M | OpenAI | 49 | US$0.18 | 184 | 35.65 | 38.36 | 详情Provider ↗ |
| GPT-5.6 Terra (high)推理模型 | 1M | OpenAI | 49 | US$0.34 | 122 | 2.32 | 6.41 | 详情Provider ↗ |
| Kimi K3 (low)推理模型 | 1.05M | Kimi | 47 | US$0.24 | 33 | 4.77 | 80.13 | 详情Provider ↗ |
| Motif 3推理模型 | 262k | Motif Technologies | 47 | — | — | — | — | 详情Provider ↗ |
| Gemini 3.1 Pro Preview推理模型 | 1M | 46 | US$0.29 | 129 | 41.27 | 45.13 | 详情Provider ↗ | |
| GPT-5.6 Luna (high)推理模型 | 1M | OpenAI | 46 | US$0.12 | 197 | 9.07 | 11.6 | 详情Provider ↗ |
| Qwen3.7 Max推理模型 | 1M | Alibaba | 46 | US$1.03 | 202 | 2.61 | 17.02 | 详情Provider ↗ |
| GPT-5.6 Terra (medium)推理模型 | 1M | OpenAI | 46 | US$0.18 | 130 | 1.64 | 5.49 | 详情Provider ↗ |
| MiniMax-M3推理模型 | 1M | MiniMax | 44 | US$0.12 | 89 | 1.63 | 29.64 | 详情Provider ↗ |
| DeepSeek V4 Pro (max)推理模型 | 1M | DeepSeek | 44 | US$0.04 | 73 | 1.51 | 68.11 | 详情Provider ↗ |
| Motif 3 (Beta)推理模型 | 262k | Motif Technologies | 44 | — | — | — | — | 详情Provider ↗ |
| DeepSeek V4 Pro (high)推理模型 | 1M | DeepSeek | 43 | US$0.04 | 75 | 1.62 | 34.8 | 详情Provider ↗ |
| Muse Spark推理模型 | 262k | Meta | 43 | — | — | — | — | 详情Provider ↗ |
| MiMo-V2.5-Pro推理模型 | 1M | Xiaomi | 42 | US$0.06 | 71 | 2.96 | 38.41 | 详情Provider ↗ |
| Kimi K2.7 Code推理模型 | 256k | Kimi | 42 | — | 45 | 2.82 | 63.96 | 详情Provider ↗ |
| Claude Sonnet 5 (Non-reasoning)非推理模型 | 1M | Anthropic | 42 | US$0.37 | 62 | 1.21 | 9.31 | 详情Provider ↗ |
| Solar Pro 4推理模型 | 512k | Upstage | 42 | US$0.22 | 65 | 2.2 | 40.53 | 详情Provider ↗ |
| Hy3推理模型 | 256k | Tencent | 41 | US$0.03 | 60 | 2.49 | 44.33 | 详情Provider ↗ |
| GPT-5.6 Sol (Non-reasoning)非推理模型 | 1M | OpenAI | 41 | US$0.26 | 75 | 1 | 7.63 | 详情Provider ↗ |
| Nex-N2-Pro推理模型 | 262k | Nex AGI | 41 | — | 136 | 1.76 | 20.18 | 详情Provider ↗ |
| Inkling推理模型 | 1M | Thinking Machines | 41 | — | 87 | 1.73 | 30.33 | 详情Provider ↗ |
| GPT-5.6 Terra (low)推理模型 | 1M | OpenAI | 40 | US$0.15 | 129 | 1.38 | 5.25 | 详情Provider ↗ |
| DeepSeek V4 Flash 0420推理模型 | 1M | DeepSeek | 40 | US$0.02 | 118 | 1.25 | 52.98 | 详情Provider ↗ |
| Qwen3.6 Plus推理模型 | 1M | Alibaba | 40 | US$0.31 | 52 | 2.51 | 119.07 | 详情Provider ↗ |
| Inkling Small推理模型 | 1M | Thinking Machines | 40 | US$0.07 | 95 | 1.67 | 27.96 | 详情Provider ↗ |
| Qwen3.7 Plus推理模型 | 1M | Alibaba | 39 | US$0.22 | 52 | 2.87 | 50.64 | 详情Provider ↗ |
| JT-4.1 Flash 236B A21B推理模型 | 256k | China Mobile | 39 | — | — | — | — | 详情Provider ↗ |
| Agnes 2.5 Pro Alpha推理模型 | 1M | Sapiens AI | 39 | — | 103 | 1.66 | 25.83 | 详情Provider ↗ |
| GPT-5.6 Luna (medium)推理模型 | 1M | OpenAI | 38 | US$0.07 | 196 | 2.84 | 5.39 | 详情Provider ↗ |
| Nemotron 3 Ultra推理模型 | 262k | NVIDIA | 38 | US$0.25 | 200 | 1.14 | 15.02 | 详情Provider ↗ |
| Ling 3.0 Flash推理模型 | 262k | InclusionAI | 38 | US$0.04 | 382 | 2.02 | 8.57 | 详情Provider ↗ |
| DeepSeek V4 Flash 0420 · AA High Effort推理模型 | 1M | DeepSeek | 37 | US$0.04 | — | — | — | 详情Provider ↗ |
| MiMo-V2.5推理模型 | 1M | Xiaomi | 37 | US$0.01 | 69 | 4.39 | 40.65 | 详情Provider ↗ |
| Qwen3.6 27B推理模型 | 262k | Alibaba | 37 | US$0.27 | 56 | 3.66 | 114.28 | 详情Provider ↗ |
| Solar Open2 250B推理模型 | 1.05M | Upstage | 37 | — | — | — | — | 详情Provider ↗ |
| Gemini 3.5 Flash-Lite推理模型 | 1M | 36 | US$0.09 | 428 | 8.11 | 9.28 | 详情Provider ↗ | |
| Muse Glimmer (high)推理模型 | 131k | Meta | 35 | US$0.07 | 99 | 0.83 | 26.01 | 详情Provider ↗ |
| A.X-K2推理模型 | 262k | SK Telecom | 35 | — | — | — | — | 详情Provider ↗ |
| GLM-5.2推理模型 | 1M | Z AI | 34 | — | 122 | 1.54 | 5.62 | 详情Provider ↗ |
| GPT-5.6 Terra (Non-reasoning)非推理模型 | 1M | OpenAI | 34 | US$0.18 | 133 | 0.78 | 4.54 | 详情Provider ↗ |
| KAT-Coder-Pro V2推理模型 | 256k | KwaiKAT | 34 | — | 103 | 1.57 | 6.42 | 详情Provider ↗ |
| Qwen3.5 397B A17B推理模型 | 262k | Alibaba | 34 | US$0.33 | 70 | 2.36 | 55.13 | 详情Provider ↗ |
| LongCat 2.0推理模型 | 1M | LongCat | 33 | — | — | — | — | 详情Provider ↗ |
| GPT-5.6 Luna (low)推理模型 | 1M | OpenAI | 33 | US$0.06 | 174 | 1.55 | 4.42 | 详情Provider ↗ |
| Qwen3.5 122B A10B推理模型 | 262k | Alibaba | 32 | US$0.24 | 133 | 2.32 | 21.09 | 详情Provider ↗ |
| Qwen3.6 35B A3B推理模型 | 262k | Alibaba | 32 | US$0.18 | 158 | 2.22 | 39.49 | 详情Provider ↗ |
| G9v3-39A5B推理模型 | 131k | AI9Stars | 32* | — | — | — | — | 详情Provider ↗ |
| Ring-2.6-1T推理模型 | 262k | InclusionAI | 31 | US$0.35 | 126 | 3.39 | 23.3 | 详情Provider ↗ |
| K-EXAONE 2.0推理模型 | 262k | LG AI Research | 31 | — | — | — | — | 详情Provider ↗ |
| Qwen3.6 27B推理模型 | 262k | Alibaba | 30 | US$0.36 | 57 | 3.63 | 12.4 | 详情Provider ↗ |
| Step 3.7 Flash推理模型 | 262k | StepFun | 30 | US$0.09 | 405 | 0.92 | 7.09 | 详情Provider ↗ |
| Mistral Medium 3.5推理模型 | 256k | Mistral | 30 | US$0.39 | 104 | 2 | 26.11 | 详情Provider ↗ |
| Claude 4.5 Haiku推理模型 | 200k | Anthropic | 30 | US$0.24 | 106 | 14.46 | 19.17 | 详情Provider ↗ |
| Gemma 4 31B推理模型 | 256k | 29 | — | 35 | 1.12 | 65.8 | 详情Provider ↗ | |
| GPT-5.5 Instant (June 2026)推理模型 | 400k | OpenAI | 29 | US$0.54 | — | — | — | 详情Provider ↗ |
| Qwen3.5 122B A10B推理模型 | 262k | Alibaba | 28 | US$0.18 | 146 | 2.37 | 5.79 | 详情Provider ↗ |
| GPT-5.6 Luna (Non-reasoning)非推理模型 | 1M | OpenAI | 27 | US$0.08 | 179 | 0.79 | 3.58 | 详情Provider ↗ |
| Gemini 2.5 Pro推理模型 | 1M | 26 | US$0.20 | 143 | 22.26 | 25.75 | 详情Provider ↗ | |
| Gemma 4 26B A4B推理模型 | 256k | 26 | US$0.03 | — | — | — | 详情Provider ↗ | |
| NVIDIA Nemotron 3 Super推理模型 | 1M | NVIDIA | 25 | US$0.21 | 187 | 1.65 | 15 | 详情Provider ↗ |
| Gemini 3.1 Flash-Lite推理模型 | 1M | 25 | US$0.04 | 329 | 6.01 | 7.53 | 详情Provider ↗ | |
| Grok 4.3 (Non-reasoning)非推理模型 | 1M | SpaceXAI | 25 | US$0.37 | 101 | 0.82 | 5.75 | 详情Provider ↗ |
| MiMo-V2-Flash推理模型 | 256k | Xiaomi | 25 | — | — | — | — | 详情Provider ↗ |
| Ling 3.0 Tiny推理模型 | 262k | InclusionAI | 25 | US$0.00 | 203 | 2.45 | 14.76 | 详情Provider ↗ |
| Qwen3.6 35B A3B推理模型 | 262k | Alibaba | 24 | US$0.60 | 200 | 2.28 | 4.78 | 详情Provider ↗ |
| Qwen3.5 35B A3B推理模型 | 262k | Alibaba | 24 | US$0.23 | 134 | 2.2 | 5.93 | 详情Provider ↗ |
| gpt-oss-120b (high)推理模型 | 131k | OpenAI | 24 | US$0.06 | 284 | 0.85 | 9.66 | 详情Provider ↗ |
| Nemotron 3.5 Lightning推理模型 | 1M | NVIDIA | 24 | US$0.06 | 293 | 1.12 | 9.64 | 详情Provider ↗ |
| Command A+推理模型 | 192k | Cohere | 23 | US$0.00 | 203 | 0.4 | 12.7 | 详情Provider ↗ |
| K-EXAONE推理模型 | 256k | LG AI Research | 22 | — | — | — | — | 详情Provider ↗ |
| Gemma 4 12B推理模型 | 256k | 22 | — | 108 | 2.44 | 25.5 | 详情Provider ↗ | |
| Gemma 4 31B推理模型 | 256k | 22 | US$0.03 | 73 | 2.28 | 9.1 | 详情Provider ↗ | |
| Nova 2.0 Pro Preview (medium)推理模型 | 256k | Amazon | 22 | US$0.17 | 117 | 15.71 | 36.99 | 详情Provider ↗ |
| Qwen3.5 9B推理模型 | 262k | Alibaba | 21 | US$0.22 | 75 | 1.57 | 35.04 | 详情Provider ↗ |
| Mercury 2推理模型 | 128k | Inception | 21 | US$0.08 | 987 | 3.93 | 4.43 | 详情Provider ↗ |
| Qwen3 Coder Next推理模型 | 256k | Alibaba | 21 | US$0.33 | 131 | 1.27 | 5.09 | 详情Provider ↗ |
| EXAONE 4.5 33B推理模型 | 262k | LG AI Research | 20 | — | — | — | — | 详情Provider ↗ |
| North Mini Code推理模型 | 256k | Cohere | 20 | US$0.00 | 64 | 0.48 | 39.46 | 详情Provider ↗ |
| Nova 2.0 Pro Preview (low)推理模型 | 256k | Amazon | 20 | US$0.21 | 121 | 9.7 | 30.38 | 详情Provider ↗ |
| Mistral Small 4推理模型 | 256k | Mistral | 20 | US$0.10 | 163 | 0.75 | 16.08 | 详情Provider ↗ |
| Devstral 2推理模型 | 256k | Mistral | 19 | US$0.00 | 36 | 1.25 | 15.28 | 详情Provider ↗ |
| Nova 2.0 Lite (high)推理模型 | 1M | Amazon | 18 | US$0.25 | 149 | 18.92 | 35.71 | 详情Provider ↗ |
| Trinity Large Thinking推理模型 | 512k | Arcee AI | 18 | US$0.13 | 166 | 0.9 | 15.97 | 详情Provider ↗ |
| Magistral Medium 1.2推理模型 | 128k | Mistral | 18 | US$0.75 | 44 | 1.71 | 58.39 | 详情Provider ↗ |
| HyperNova 60B 2605推理模型 | 131k | Multiverse Computing | 18 | US$0.02 | 364 | 0.91 | 7.78 | 详情Provider ↗ |
| Nemotron Cascade 2 30B A3B推理模型 | 1M | NVIDIA | 18 | — | — | — | — | 详情Provider ↗ |
| Devstral Small 2推理模型 | 256k | Mistral | 17 | US$0.00 | 34 | 1.33 | 16.02 | 详情Provider ↗ |
| K2 Think V2推理模型 | 262k | MBZUAI Institute of Foundation Models | 17 | — | — | — | — | 详情Provider ↗ |
| Qwen3 Next 80B A3B推理模型 | 262k | Alibaba | 17 | US$0.17 | 210 | 2.24 | 14.12 | 详情Provider ↗ |
| G9v3-3B推理模型 | 131k | AI9Stars | 16 | — | — | — | — | 详情Provider ↗ |
| Mistral Large 3推理模型 | 256k | Mistral | 16 | US$0.06 | 49 | 1.14 | 11.4 | 详情Provider ↗ |
| gpt-oss-120b (low)推理模型 | 131k | OpenAI | 15 | US$0.02 | 295 | 0.85 | 9.32 | 详情Provider ↗ |
| gpt-oss-20b (high)推理模型 | 131k | OpenAI | 15 | US$0.02 | 197 | 0.82 | 13.53 | 详情Provider ↗ |
| Nova 2.0 Pro Preview推理模型 | 256k | Amazon | 14 | US$0.25 | 109 | 1.03 | 5.6 | 详情Provider ↗ |
| Llama 4 Maverick推理模型 | 1M | Meta | 14 | US$0.03 | 105 | 0.93 | 5.7 | 详情Provider ↗ |
| NVIDIA Nemotron 3 Nano推理模型 | 1M | NVIDIA | 14 | US$0.02 | 156 | 1.37 | 17.44 | 详情Provider ↗ |
| Solar Pro 3推理模型 | 128k | Upstage | 14 | — | — | — | — | 详情Provider ↗ |
| Ling 2.6 Flash推理模型 | 262k | InclusionAI | 14 | — | 130 | 1.13 | 4.97 | 详情Provider ↗ |
| DiffusionGemma 26B A4B推理模型 | 256k | 13 | — | — | — | — | 详情Provider ↗ | |
| Gemma 4 E4B推理模型 | 128k | 12 | — | 90 | 0.79 | 28.67 | 详情Provider ↗ | |
| Celeris-1推理模型 | 131k | Celeris | 12 | — | 2,038 | 0.65 | 0.9 | 详情Provider ↗ |
| Magistral Small 1.2推理模型 | 128k | Mistral | 11 | US$0.25 | 88 | 0.93 | 29.29 | 详情Provider ↗ |
| Nanbeige4.1-3B推理模型 | 256k | Nanbeige | 11 | — | — | — | — | 详情Provider ↗ |
| Ministral 3 14B推理模型 | 256k | Mistral | 11 | US$0.15 | 62 | 0.85 | 8.9 | 详情Provider ↗ |
| Llama 4 Scout推理模型 | 10M | Meta | 10 | US$0.01 | 96 | 0.76 | 5.98 | 详情Provider ↗ |
| Gemma 4 E2B推理模型 | 128k | 9 | — | — | — | — | 详情Provider ↗ | |
| Llama 3.3 70B推理模型 | 128k | Meta | 9 | US$0.08 | 85 | 1.66 | 7.54 | 详情Provider ↗ |
| Ministral 3 8B推理模型 | 256k | Mistral | 9 | US$0.18 | 112 | 0.73 | 5.18 | 详情Provider ↗ |
| Granite 4.1 30B推理模型 | 131k | IBM | 9 | — | — | — | — | 详情Provider ↗ |
| NVIDIA Nemotron 3 Nano 4B推理模型 | 262k | NVIDIA | 9 | — | — | — | — | 详情Provider ↗ |
| Qwen3.5 2B推理模型 | 262k | Alibaba | 7 | — | — | — | — | 详情Provider ↗ |
| Ministral 3 3B推理模型 | 256k | Mistral | 6 | US$0.13 | 251 | 0.63 | 2.62 | 详情Provider ↗ |
| Phi-4 Mini推理模型 | 128k | Microsoft | 6 | US$0.00 | 45 | 0.83 | 11.96 | 详情Provider ↗ |
| Qwen3.5 2B推理模型 | 262k | Alibaba | 6 | — | — | — | — | 详情Provider ↗ |
| Qwen3.5 0.8B推理模型 | 262k | Alibaba | 5 | — | — | — | — | 详情Provider ↗ |
| Granite 4.1 3B推理模型 | 131k | IBM | 5 | — | — | — | — | 详情Provider ↗ |
| MiniCPM-V 4.6 1.3B推理模型 | 262k | OpenBMB | 4 | — | — | — | — | 详情Provider ↗ |
| Qwen3.5 0.8B推理模型 | 262k | Alibaba | 3 | — | — | — | — | 详情Provider ↗ |
仅比较同一评测版本;v4.1 保留为历史参考,不与 v4.3 混排。单任务成本不是当前 API 价格。“—”表示该项未知;带 * 的指数来自原始榜单的估算标记。
一次请求可容纳的输入与输出 Token 总量,不等于模型一定能有效利用全部长度。
发出请求到收到第一个 Token 的时间,越低意味着越快开始回答。
从请求发出到回答完成的总时间,受推理长度和输出速度共同影响。
FAQ
AI 模型排行榜常见问题
回答只使用本站已公开的指标定义和比较边界。
AI 模型排行榜前十名应该怎么看?
先固定任务和指标,再查看同一列的前十名。综合能力、Coding、中文、价格和速度不是同一量纲,不能把不同榜单直接相加。
哪个 AI 模型最好用?
没有脱离任务的唯一最好模型。复杂推理优先看公开能力评测,编码任务看 Coding Agent 与代码基准,生产调用还要同时检查价格、速度、延迟和上下文。
国内大模型应该怎样比较?
先在完整表中按机构与模型名称筛选,再分别核对中文任务、Coding、能力、成本和开放权重;不要用机构国别代替模型实测结果。
怎样同时比较模型价格与速度?
使用本页表格的单任务成本、输出速度、首字等待和完整响应列,并保持 Provider、模型版本与快照日期一致。