MODEL ANALYSIS

GPT-5 (high)

GPT-5 (high)(OpenAI)公开数据详情:智能指数 23.0(v4.3)、生成速度 101.1 Token/s、上下文 400,000 Token、历史单任务成本 US$0.24。评测来源 Artificial Analysis;规格来源 Artificial Analysis,快照 2026-09-19;各字段保留原始来源与观测时间。

数据快照:2026-09-19查看原始来源 ↗
智能指数 · v4.323.0*暂无排名
生成速度101.1Token/s
API 价格当前 API 未核实 · Artificial Analysis model aggregate 历史输入 $1.25 / 输出 $10(2026-07-21)
单任务成本 · 历史参考$0.24来源未提供可比较价格
单任务输出 · 历史参考17,302Token

评测按字段保留来源版本与观测时间。Intelligence Index v4.3 观测于 2026-09-09T14:00:04.717Z。 单任务成本、Token 与完整评测成本仍为此前快照参考,不代表新版评测或当前 API 报价。详情可在指标历史核对。

模型概览

GPT-5 (high) 的 Intelligence Index v4.3 为 23.0(估算值),生成速度为 101.1 Token/s,历史完整评测成本为 US$778.33。这些指标分别反映能力、吞吐和评测经济性;旧成本未与新版指数绑定,不能合并成单一“最好”结论。

技术规格

机构
OpenAI
发布日期
2025-08-07
推理类型
推理模型
模型权重
未开放权重
上下文窗口
400,000 Token
输入模态
文本、图像
输出模态
文本
性能来源
OpenAI

INTERACTIVE COMPARISON

模型指标比较器

切换指标并按状态、推理类型和权重开放性筛选。首屏服务端呈现前 24 个模型,浏览器随后载入完整数据;历史参考配置可在“历史”或“全部”中查看。

23 / 653 个模型 · 正在载入全量数据

仅比较 v4.3 同版本观测;不跨方法版本排序。估算指数保留来源的暂定性质。

智能指数模型比较;当前显示 23 个模型。Claude Fable 5.1 (max with …53.4Claude Fable 5.1 (xhigh wit…53.2GPT-6 Astra (max)52.8GPT-6 Astra (xhigh)52.5Claude Fable 5.1 (high with…51.2GPT-6 Astra (high)51Claude Opus 5 (max)50.7Claude Fable 549.7GPT-6 Astra (medium)49.7Claude Opus 5 (xhigh)49.7Claude Fable 5.1 (medium wi…49.1Claude Opus 5 (high)48.2Muse Spark 1.3 (max)48.2GPT-5.6 Sol (max)47.1Claude Fable 5.1 (low with …47GPT-6 Astra (low)46Qwen3.8 Max (0902)45.4Muse Spark 1.3 (xhigh)45.2Claude Opus 5 (medium)45.1GLM-5.344.9Grok 4.6 (high)44.4Grok 4.6 (xhigh)44.3GPT-5.6 Sol (xhigh)44.1

INTELLIGENCE

Artificial Analysis 智能指数 · v4.3

v4.3 按 Agent、编码、通用与科学推理四类能力组合。仅在同版本内比较;数值越高越好。本页配置原观测于 2026-09-09T14:00:04.717Z。蓝色代表当前模型。

模型智能指数对比 · v4.3
模型智能指数对比 · v4.3;公开数据053.4Claude Fable 5.1 (max with fallback): 53.4;AnthropicClaude Fable 5.1 (max with fa…53.4Claude Fable 5.1 (xhigh with fallback): 53.2;AnthropicClaude Fable 5.1 (xhigh with …53.2GPT-6 Astra (max): 52.8;OpenAIGPT-6 Astra (max)52.8GPT-6 Astra (xhigh): 52.5;OpenAIGPT-6 Astra (xhigh)52.5Claude Fable 5.1 (high with fallback): 51.2;AnthropicClaude Fable 5.1 (high with f…51.2GPT-6 Astra (high): 51;OpenAIGPT-6 Astra (high)51Claude Opus 5 (max): 50.7;AnthropicClaude Opus 5 (max)50.7Claude Fable 5: 49.7;AnthropicClaude Fable 549.7GPT-6 Astra (medium): 49.7;OpenAIGPT-6 Astra (medium)49.7Claude Opus 5 (xhigh): 49.7;AnthropicClaude Opus 5 (xhigh)49.7Claude Fable 5.1 (medium with fallback): 49.1;AnthropicClaude Fable 5.1 (medium with…49.1Claude Opus 5 (high): 48.2;AnthropicClaude Opus 5 (high)48.2Muse Spark 1.3 (max): 48.2;MetaMuse Spark 1.3 (max)48.2GPT-5.6 Sol (max): 47.1;OpenAIGPT-5.6 Sol (max)47.1Claude Fable 5.1 (low with fallback): 47;AnthropicClaude Fable 5.1 (low with fa…47GPT-6 Astra (low): 46;OpenAIGPT-6 Astra (low)46Qwen3.8 Max (0902): 45.4;AlibabaQwen3.8 Max (0902)45.4Muse Spark 1.3 (xhigh): 45.2;MetaMuse Spark 1.3 (xhigh)45.2Claude Opus 5 (medium): 45.1;AnthropicClaude Opus 5 (medium)45.1GLM-5.3: 44.9;Z AIGLM-5.344.9
查看图表数据
项目数值
Claude Fable 5.1 (max with fallback)53.4
Claude Fable 5.1 (xhigh with fallback)53.2
GPT-6 Astra (max)52.8
GPT-6 Astra (xhigh)52.5
Claude Fable 5.1 (high with fallback)51.2
GPT-6 Astra (high)51
Claude Opus 5 (max)50.7
Claude Fable 549.7
GPT-6 Astra (medium)49.7
Claude Opus 5 (xhigh)49.7
Claude Fable 5.1 (medium with fallback)49.1
Claude Opus 5 (high)48.2
Muse Spark 1.3 (max)48.2
GPT-5.6 Sol (max)47.1
Claude Fable 5.1 (low with fallback)47
GPT-6 Astra (low)46
Qwen3.8 Max (0902)45.4
Muse Spark 1.3 (xhigh)45.2
Claude Opus 5 (medium)45.1
GLM-5.344.9

INTELLIGENCE BREAKDOWN

组成评测 · v4.3

仅展示该版本逐项核实的原始指标;缺少同版本观测的字段不从历史回填。Elo、指数与通过率不能当作同一量纲排序;幻觉率越低越好。

GPT-5 (high) 的分项原始指标
指标原始成绩
GDPval-AA v2 Elo · 裁判协议 v4.3.11014.9
AA-Omniscience 准确率40.3%
AA-Omniscience 幻觉率(越低越好)82.2%
AA-LCR v1.178.2%
Humanity's Last Exam28.5%
CritPt5.7%

AA-OMNISCIENCE

知识与幻觉

指数同时考虑正确回答和避免幻觉。当前模型准确率 40.3%,幻觉率 82.2%。

AA-Omniscience 指数对比
AA-Omniscience 指数对比;公开数据043.7GPT-6 Astra (high): 43.7;OpenAIGPT-6 Astra (high)43.7Claude Fable 5.1 (max with fallback): 43.5;AnthropicClaude Fable 5.1 (max with fa…43.5GPT-6 Astra (xhigh): 43.4;OpenAIGPT-6 Astra (xhigh)43.4GPT-6 Astra (max): 43.4;OpenAIGPT-6 Astra (max)43.4Claude Fable 5: 43.3;AnthropicClaude Fable 543.3Claude Fable 5.1 (xhigh with fallback): 42.4;AnthropicClaude Fable 5.1 (xhigh with …42.4GPT-6 Astra (medium): 42.2;OpenAIGPT-6 Astra (medium)42.2Claude Fable 5.1 (high with fallback): 40.8;AnthropicClaude Fable 5.1 (high with f…40.8GPT-6 Astra (low): 40.6;OpenAIGPT-6 Astra (low)40.6Claude Fable 5.1 (medium with fallback): 37.6;AnthropicClaude Fable 5.1 (medium with…37.6Claude Opus 5 (max): 37.1;AnthropicClaude Opus 5 (max)37.1Claude Opus 5 (xhigh): 35.4;AnthropicClaude Opus 5 (xhigh)35.4Claude Fable 5.1 (low with fallback): 34.1;AnthropicClaude Fable 5.1 (low with fa…34.1Claude Opus 5 (high): 33.7;AnthropicClaude Opus 5 (high)33.7Gemini 3.1 Pro Preview: 31.9;GoogleGemini 3.1 Pro Preview31.9Claude Opus 5 (medium): 31;AnthropicClaude Opus 5 (medium)31Grok 4.6 (high): 30.5;SpaceXAIGrok 4.6 (high)30.5Gemini 3.8 Flash (high): 29.6;GoogleGemini 3.8 Flash (high)29.6Grok 4.6 (xhigh): 29.3;SpaceXAIGrok 4.6 (xhigh)29.3Gemini 3.8 Flash (medium): 28.6;GoogleGemini 3.8 Flash (medium)28.6
查看图表数据
项目数值
GPT-6 Astra (high)43.7
Claude Fable 5.1 (max with fallback)43.5
GPT-6 Astra (xhigh)43.4
GPT-6 Astra (max)43.4
Claude Fable 543.3
Claude Fable 5.1 (xhigh with fallback)42.4
GPT-6 Astra (medium)42.2
Claude Fable 5.1 (high with fallback)40.8
GPT-6 Astra (low)40.6
Claude Fable 5.1 (medium with fallback)37.6
Claude Opus 5 (max)37.1
Claude Opus 5 (xhigh)35.4
Claude Fable 5.1 (low with fallback)34.1
Claude Opus 5 (high)33.7
Gemini 3.1 Pro Preview31.9
Claude Opus 5 (medium)31
Grok 4.6 (high)30.5
Gemini 3.8 Flash (high)29.6
Grok 4.6 (xhigh)29.3
Gemini 3.8 Flash (medium)28.6

TOKEN USE

输出 Token 使用

Token 更多不等于回答更好;它同时影响成本和等待时间。先看同任务下的回答与推理构成。

单次 Intelligence 任务输出 Token
单次 Intelligence 任务输出 Token;公开数据06,573 TokenLlama 4 Scout: 1,312 Token;MetaLlama 4 Scout1,312 TokenGPT-5.6 Luna (Non-reasoning): 2,238 Token;OpenAIGPT-5.6 Luna (Non-reasoning)2,238 TokenGPT-5.6 Sol (Non-reasoning): 2,304 Token;OpenAIGPT-5.6 Sol (Non-reasoning)2,304 TokenLlama 4 Maverick: 2,332 Token;MetaLlama 4 Maverick2,332 TokenGPT-5.6 Terra (Non-reasoning): 2,354 Token;OpenAIGPT-5.6 Terra (Non-reasoning)2,354 TokenGPT-5.6 Luna (low): 2,478 Token;OpenAIGPT-5.6 Luna (low)2,478 TokenGPT-5.6 Terra (low): 2,504 Token;OpenAIGPT-5.6 Terra (low)2,504 TokenGPT-5.5 Instant (June 2026): 2,516 Token;OpenAIGPT-5.5 Instant (June 2026)2,516 Tokengpt-oss-120b (low): 2,762 Token;OpenAIgpt-oss-120b (low)2,762 TokenGPT-5.6 Sol (low): 2,834 Token;OpenAIGPT-5.6 Sol (low)2,834 TokenMistral Large 3: 3,366 Token;MistralMistral Large 33,366 TokenGPT-5.6 Luna (medium): 3,940 Token;OpenAIGPT-5.6 Luna (medium)3,940 TokenGPT-5.6 Terra (medium): 4,143 Token;OpenAIGPT-5.6 Terra (medium)4,143 TokenKimi K3 (low): 4,197 Token;KimiKimi K3 (low)4,197 TokenGemma 4 31B: 4,680 Token;GoogleGemma 4 31B4,680 TokenGPT-5.6 Sol (medium): 4,758 Token;OpenAIGPT-5.6 Sol (medium)4,758 TokenGrok 4.6 (low): 5,566 Token;SpaceXAIGrok 4.6 (low)5,566 TokenDevstral 2: 6,222 Token;MistralDevstral 26,222 TokenDevstral Small 2: 6,536 Token;MistralDevstral Small 26,536 TokenClaude Opus 5 (low): 6,573 Token;AnthropicClaude Opus 5 (low)6,573 Token
查看图表数据
项目数值
Llama 4 Scout1,312 Token
GPT-5.6 Luna (Non-reasoning)2,238 Token
GPT-5.6 Sol (Non-reasoning)2,304 Token
Llama 4 Maverick2,332 Token
GPT-5.6 Terra (Non-reasoning)2,354 Token
GPT-5.6 Luna (low)2,478 Token
GPT-5.6 Terra (low)2,504 Token
GPT-5.5 Instant (June 2026)2,516 Token
gpt-oss-120b (low)2,762 Token
GPT-5.6 Sol (low)2,834 Token
Mistral Large 33,366 Token
GPT-5.6 Luna (medium)3,940 Token
GPT-5.6 Terra (medium)4,143 Token
Kimi K3 (low)4,197 Token
Gemma 4 31B4,680 Token
GPT-5.6 Sol (medium)4,758 Token
Grok 4.6 (low)5,566 Token
Devstral 26,222 Token
Devstral Small 26,536 Token
Claude Opus 5 (low)6,573 Token
GPT-5 (high) 的回答 / 推理 Token 构成
回答 Token推理 Token
GPT-5 (high) 的回答 / 推理 Token 构成GPT-5 (high): 17,302 TokenGPT-5 (high)17,302 Token
查看图表数据
项目合计回答 Token推理 Token
GPT-5 (high)17,302 Token4,059 Token13,243 Token

PRICE AND COST

价格与评测成本

API 标价、单任务成本和跑完整套评测的成本是三个不同口径,这里分开呈现。

单次 Intelligence 任务成本
单次 Intelligence 任务成本;公开数据01 美元Granite 4.2 3B: 0 美元;IBMGranite 4.2 3B0 美元GPT-5.6 Luna (low): 0.01 美元;OpenAIGPT-5.6 Luna (low)0.01 美元MiMo-V2.5: 0.01 美元;XiaomiMiMo-V2.50.01 美元Llama 4 Scout: 0.01 美元;MetaLlama 4 Scout0.01 美元GPT-5.6 Luna (medium): 0.01 美元;OpenAIGPT-5.6 Luna (medium)0.01 美元GPT-5.6 Luna (Non-reasoning): 0.01 美元;OpenAIGPT-5.6 Luna (Non-reasoning)0.01 美元Granite 4.2 8B: 0.02 美元;IBMGranite 4.2 8B0.02 美元gpt-oss-120b (low): 0.02 美元;OpenAIgpt-oss-120b (low)0.02 美元GPT-5.6 Luna (high): 0.02 美元;OpenAIGPT-5.6 Luna (high)0.02 美元HyperNova 60B 2605: 0.02 美元;Multiverse ComputingHyperNova 60B 26050.02 美元Nemotron 3 Nano: 0.02 美元;NVIDIANemotron 3 Nano0.02 美元gpt-oss-20b (high): 0.02 美元;OpenAIgpt-oss-20b (high)0.02 美元Granite 4.2 30B: 0.03 美元;IBMGranite 4.2 30B0.03 美元GPT-5.6 Luna (xhigh): 0.03 美元;OpenAIGPT-5.6 Luna (xhigh)0.03 美元MiMo-V2.5-Pro: 0.03 美元;XiaomiMiMo-V2.5-Pro0.03 美元Llama 4 Maverick: 0.03 美元;MetaLlama 4 Maverick0.03 美元Hy3: 0.04 美元;TencentHy30.04 美元Ling 3.0 Flash: 0.04 美元;InclusionAILing 3.0 Flash0.04 美元Gemma 4 26B A4B: 0.04 美元;GoogleGemma 4 26B A4B0.04 美元Qwen3 Next 80B A3B: 0.04 美元;AlibabaQwen3 Next 80B A3B0.04 美元
查看图表数据
项目数值
Granite 4.2 3B0 美元
GPT-5.6 Luna (low)0.01 美元
MiMo-V2.50.01 美元
Llama 4 Scout0.01 美元
GPT-5.6 Luna (medium)0.01 美元
GPT-5.6 Luna (Non-reasoning)0.01 美元
Granite 4.2 8B0.02 美元
gpt-oss-120b (low)0.02 美元
GPT-5.6 Luna (high)0.02 美元
HyperNova 60B 26050.02 美元
Nemotron 3 Nano0.02 美元
gpt-oss-20b (high)0.02 美元
Granite 4.2 30B0.03 美元
GPT-5.6 Luna (xhigh)0.03 美元
MiMo-V2.5-Pro0.03 美元
Llama 4 Maverick0.03 美元
Hy30.04 美元
Ling 3.0 Flash0.04 美元
Gemma 4 26B A4B0.04 美元
Qwen3 Next 80B A3B0.04 美元
GPT-5 (high) 单任务成本构成
非缓存输入缓存读取缓存写入回答输出推理输出
GPT-5 (high) 单任务成本构成单任务: 0.24 美元单任务0.24 美元
查看图表数据
项目合计非缓存输入缓存读取缓存写入回答输出推理输出
单任务0.24 美元0.01 美元0.03 美元0.04 美元0.04 美元0.13 美元
运行完整 Intelligence Index 的成本构成
非缓存输入缓存读取缓存写入回答输出推理输出
运行完整 Intelligence Index 的成本构成完整 Intelligence Index: 778.33 美元完整 Intelligence Index778.33 美元
查看图表数据
项目合计非缓存输入缓存读取缓存写入回答输出推理输出
完整 Intelligence Index778.33 美元15.24 美元24 美元29.82 美元43.9 美元665.36 美元

CONTEXT WINDOW

上下文窗口

上下文窗口表示单次请求可处理的最大 Token 数,不代表模型一定能在全窗口内保持同等检索质量。

上下文窗口对比
上下文窗口对比;公开数据010,000,000 TokenLlama 4 Scout: 10,000,000 Token;MetaLlama 4 Scout10,000,000 TokenMuse Spark 1.2 (xhigh): 1,048,576 Token;MetaMuse Spark 1.2 (xhigh)1,048,576 TokenKimi K3 (low): 1,048,576 Token;KimiKimi K3 (low)1,048,576 TokenSolar Open2 250B: 1,048,576 Token;UpstageSolar Open2 250B1,048,576 TokenKimi K3 (max): 1,048,576 Token;KimiKimi K3 (max)1,048,576 TokenMiMo-V2.5-Pro: 1,000,000 Token;XiaomiMiMo-V2.5-Pro1,000,000 TokenNova 2.0 Omni (medium): 1,000,000 Token;AmazonNova 2.0 Omni (medium)1,000,000 TokenGemini 3.5 Flash (minimal): 1,000,000 Token;GoogleGemini 3.5 Flash (minimal)1,000,000 TokenGPT-5.6 Luna (low): 1,000,000 Token;OpenAIGPT-5.6 Luna (low)1,000,000 TokenGPT-5.6 Sol (low): 1,000,000 Token;OpenAIGPT-5.6 Sol (low)1,000,000 TokenGemini 3.5 Flash-Lite: 1,000,000 Token;GoogleGemini 3.5 Flash-Lite1,000,000 TokenInkling: 1,000,000 Token;Thinking MachinesInkling1,000,000 TokenClaude Opus 5 (xhigh): 1,000,000 Token;AnthropicClaude Opus 5 (xhigh)1,000,000 TokenClaude Sonnet 5 (low): 1,000,000 Token;AnthropicClaude Sonnet 5 (low)1,000,000 TokenGLM-5.3-Flash: 1,000,000 Token;Z AIGLM-5.3-Flash1,000,000 TokenNova 2.0 Omni: 1,000,000 Token;AmazonNova 2.0 Omni1,000,000 TokenClaude Opus 5 (low): 1,000,000 Token;AnthropicClaude Opus 5 (low)1,000,000 TokenMiMo-V2.5: 1,000,000 Token;XiaomiMiMo-V2.51,000,000 TokenNemotron 3 Nano: 1,000,000 Token;NVIDIANemotron 3 Nano1,000,000 TokenClaude Sonnet 5 (max): 1,000,000 Token;AnthropicClaude Sonnet 5 (max)1,000,000 Token
查看图表数据
项目数值
Llama 4 Scout10,000,000 Token
Muse Spark 1.2 (xhigh)1,048,576 Token
Kimi K3 (low)1,048,576 Token
Solar Open2 250B1,048,576 Token
Kimi K3 (max)1,048,576 Token
MiMo-V2.5-Pro1,000,000 Token
Nova 2.0 Omni (medium)1,000,000 Token
Gemini 3.5 Flash (minimal)1,000,000 Token
GPT-5.6 Luna (low)1,000,000 Token
GPT-5.6 Sol (low)1,000,000 Token
Gemini 3.5 Flash-Lite1,000,000 Token
Inkling1,000,000 Token
Claude Opus 5 (xhigh)1,000,000 Token
Claude Sonnet 5 (low)1,000,000 Token
GLM-5.3-Flash1,000,000 Token
Nova 2.0 Omni1,000,000 Token
Claude Opus 5 (low)1,000,000 Token
MiMo-V2.51,000,000 Token
Nemotron 3 Nano1,000,000 Token
Claude Sonnet 5 (max)1,000,000 Token

OUTPUT SPEED

回答生成速度

模型开始输出后每秒生成的 Token;不包含开始回答前的等待时间。

输出速度对比
输出速度对比;公开数据01,574.3 Token/sCeleris-1: 1,574.3 Token/s;CelerisCeleris-11,574.3 Token/sMercury 2: 1,004.5 Token/s;InceptionMercury 21,004.5 Token/sLing 3.0 Flash: 385.3 Token/s;InclusionAILing 3.0 Flash385.3 Token/sHyperNova 60B 2605: 365.7 Token/s;Multiverse ComputingHyperNova 60B 2605365.7 Token/sLFM2.5-VL-1.6B: 359 Token/s;Liquid AILFM2.5-VL-1.6B359 Token/sGemini 3.5 Flash-Lite: 352.7 Token/s;GoogleGemini 3.5 Flash-Lite352.7 Token/sLFM2.5-8B-A1B: 338.6 Token/s;Liquid AILFM2.5-8B-A1B338.6 Token/sNemotron 3 Nano Omni 30B A3B: 327.6 Token/s;NVIDIANemotron 3 Nano Omni 30B A3B327.6 Token/sGemini 3.7 Flash (high): 321.9 Token/s;GoogleGemini 3.7 Flash (high)321.9 Token/sGemini 3.7 Flash (low): 319.6 Token/s;GoogleGemini 3.7 Flash (low)319.6 Token/sGemini 3.7 Flash (medium): 318.2 Token/s;GoogleGemini 3.7 Flash (medium)318.2 Token/sNova Micro: 306.7 Token/s;AmazonNova Micro306.7 Token/sNemotron 3.5 Lightning: 293.2 Token/s;NVIDIANemotron 3.5 Lightning293.2 Token/sCommand A+: 268.8 Token/s;CohereCommand A+268.8 Token/sQwen3.5 Omni Flash: 249.9 Token/s;AlibabaQwen3.5 Omni Flash249.9 Token/sDeepSeek V4 Flash: 232.3 Token/s;DeepSeekDeepSeek V4 Flash232.3 Token/sNemotron 3 Nano: 221.7 Token/s;NVIDIANemotron 3 Nano221.7 Token/sGranite 4.2 3B: 219.8 Token/s;IBMGranite 4.2 3B219.8 Token/sNemotron 3 Nano: 218.7 Token/s;NVIDIANemotron 3 Nano218.7 Token/sNVIDIA Nemotron Nano 9B V2: 203.9 Token/s;NVIDIANVIDIA Nemotron Nano 9B V2203.9 Token/s
查看图表数据
项目数值
Celeris-11,574.3 Token/s
Mercury 21,004.5 Token/s
Ling 3.0 Flash385.3 Token/s
HyperNova 60B 2605365.7 Token/s
LFM2.5-VL-1.6B359 Token/s
Gemini 3.5 Flash-Lite352.7 Token/s
LFM2.5-8B-A1B338.6 Token/s
Nemotron 3 Nano Omni 30B A3B327.6 Token/s
Gemini 3.7 Flash (high)321.9 Token/s
Gemini 3.7 Flash (low)319.6 Token/s
Gemini 3.7 Flash (medium)318.2 Token/s
Nova Micro306.7 Token/s
Nemotron 3.5 Lightning293.2 Token/s
Command A+268.8 Token/s
Qwen3.5 Omni Flash249.9 Token/s
DeepSeek V4 Flash232.3 Token/s
Nemotron 3 Nano221.7 Token/s
Granite 4.2 3B219.8 Token/s
Nemotron 3 Nano218.7 Token/s
NVIDIA Nemotron Nano 9B V2203.9 Token/s
单次 Intelligence 任务耗时
单次 Intelligence 任务耗时;公开数据060.9 秒Celeris-1: 9 秒;CelerisCeleris-19 秒Llama 4 Scout: 10 秒;MetaLlama 4 Scout10 秒GPT-5.5 Instant (June 2026): 17.4 秒;OpenAIGPT-5.5 Instant (June 2026)17.4 秒gpt-oss-120b (low): 19 秒;OpenAIgpt-oss-120b (low)19 秒GPT-5.6 Luna (Non-reasoning): 20.8 秒;OpenAIGPT-5.6 Luna (Non-reasoning)20.8 秒GPT-5.6 Luna (low): 22.4 秒;OpenAIGPT-5.6 Luna (low)22.4 秒Llama 4 Maverick: 23 秒;MetaLlama 4 Maverick23 秒GPT-5.6 Terra (low): 24 秒;OpenAIGPT-5.6 Terra (low)24 秒GPT-5.6 Terra (Non-reasoning): 24.3 秒;OpenAIGPT-5.6 Terra (Non-reasoning)24.3 秒Mercury 2: 28.1 秒;InceptionMercury 228.1 秒GPT-5.6 Sol (Non-reasoning): 33.7 秒;OpenAIGPT-5.6 Sol (Non-reasoning)33.7 秒GPT-5.6 Luna (medium): 35.1 秒;OpenAIGPT-5.6 Luna (medium)35.1 秒GPT-5.6 Sol (low): 37.9 秒;OpenAIGPT-5.6 Sol (low)37.9 秒Gemini 3.5 Flash-Lite: 38.4 秒;GoogleGemini 3.5 Flash-Lite38.4 秒Gemini 3.7 Flash (low): 42.5 秒;GoogleGemini 3.7 Flash (low)42.5 秒GPT-5.6 Terra (medium): 44.3 秒;OpenAIGPT-5.6 Terra (medium)44.3 秒Devstral Small 2: 47.6 秒;MistralDevstral Small 247.6 秒Granite 4.2 3B: 52.7 秒;IBMGranite 4.2 3B52.7 秒Gemma 4 31B: 57.2 秒;GoogleGemma 4 31B57.2 秒Qwen3.5 122B A10B: 60.9 秒;AlibabaQwen3.5 122B A10B60.9 秒
查看图表数据
项目数值
Celeris-19 秒
Llama 4 Scout10 秒
GPT-5.5 Instant (June 2026)17.4 秒
gpt-oss-120b (low)19 秒
GPT-5.6 Luna (Non-reasoning)20.8 秒
GPT-5.6 Luna (low)22.4 秒
Llama 4 Maverick23 秒
GPT-5.6 Terra (low)24 秒
GPT-5.6 Terra (Non-reasoning)24.3 秒
Mercury 228.1 秒
GPT-5.6 Sol (Non-reasoning)33.7 秒
GPT-5.6 Luna (medium)35.1 秒
GPT-5.6 Sol (low)37.9 秒
Gemini 3.5 Flash-Lite38.4 秒
Gemini 3.7 Flash (low)42.5 秒
GPT-5.6 Terra (medium)44.3 秒
Devstral Small 247.6 秒
Granite 4.2 3B52.7 秒
Gemma 4 31B57.2 秒
Qwen3.5 122B A10B60.9 秒

LATENCY

首个回答 Token 等待

推理模型的等待时间可能包含内部推理;低延迟更适合实时交互。

首个回答 Token:输入处理与推理等待
输入处理推理等待
首个回答 Token:输入处理与推理等待Celeris-1: 0.6 秒Celeris-10.6 秒Ministral 3 3B: 0.6 秒Ministral 3 3B0.6 秒DeepSeek V4 Flash: 0.7 秒DeepSeek V4 Flash0.7 秒Qwen3.5 4B: 0.7 秒Qwen3.5 4B0.7 秒Gemma 4 E4B: 0.7 秒Gemma 4 E4B0.7 秒Grok 4.3 (Non-reasoning): 0.7 秒Grok 4.3 (Non-reasoning)0.7 秒Granite 4.1 8B: 0.8 秒Granite 4.1 8B0.8 秒Llama 4 Scout: 0.8 秒Llama 4 Scout0.8 秒Ministral 3 8B: 0.8 秒Ministral 3 8B0.8 秒GPT-5 (high): 91.9 秒GPT-5 (high)91.9 秒
查看图表数据
项目合计输入处理推理等待
Celeris-10.6 秒0.6 秒0 秒
Ministral 3 3B0.6 秒0.6 秒0 秒
DeepSeek V4 Flash0.7 秒0.7 秒0 秒
Qwen3.5 4B0.7 秒0.7 秒0 秒
Gemma 4 E4B0.7 秒0.7 秒0 秒
Grok 4.3 (Non-reasoning)0.7 秒0.7 秒0 秒
Granite 4.1 8B0.8 秒0.8 秒0 秒
Llama 4 Scout0.8 秒0.8 秒0 秒
Ministral 3 8B0.8 秒0.8 秒0 秒
GPT-5 (high)91.9 秒91.9 秒0 秒

END-TO-END RESPONSE TIME

端到端响应时间

按收到 500 个输出 Token 计算,合计输入处理、推理和文本生成时间。

输出 500 Token 的完整响应时间
输入处理推理生成 500 Token
输出 500 Token 的完整响应时间Celeris-1: 0.9 秒Celeris-10.9 秒Nova Micro: 2.5 秒Nova Micro2.5 秒Gemini 3.7 Flash (low): 2.5 秒Gemini 3.7 Flash (low)2.5 秒LFM2.5-VL-1.6B: 2.7 秒LFM2.5-VL-1.6B2.7 秒DeepSeek V4 Flash: 2.8 秒DeepSeek V4 Flash2.8 秒Nemotron 3 Nano: 3.2 秒Nemotron 3 Nano3.2 秒Ministral 3 3B: 3.5 秒Ministral 3 3B3.5 秒Gemini 3.5 Flash (minimal): 3.5 秒Gemini 3.5 Flash (minimal)3.5 秒Qwen3.5 Omni Flash: 3.8 秒Qwen3.5 Omni Flash3.8 秒GPT-5 (high): 96.8 秒GPT-5 (high)96.8 秒
查看图表数据
项目合计输入处理推理生成 500 Token
Celeris-10.9 秒0.6 秒0 秒0.3 秒
Nova Micro2.5 秒0.8 秒0 秒1.6 秒
Gemini 3.7 Flash (low)2.5 秒1 秒0 秒1.6 秒
LFM2.5-VL-1.6B2.7 秒1.3 秒0 秒1.4 秒
DeepSeek V4 Flash2.8 秒2.8 秒0 秒0 秒
Nemotron 3 Nano3.2 秒0.9 秒0 秒2.3 秒
Ministral 3 3B3.5 秒0.6 秒0 秒2.9 秒
Gemini 3.5 Flash (minimal)3.5 秒0.9 秒0 秒2.6 秒
Qwen3.5 Omni Flash3.8 秒1.8 秒0 秒2 秒
GPT-5 (high)96.8 秒91.9 秒0 秒4.9 秒

CAPABILITY INDICES

专业能力指数

不同专题由不同评测组合形成,适合在相同专题内比较,不应跨专题直接比较。

GPT-5 (high) 的专业能力成绩
专题能力指数单任务成本任务耗时输出 Token
Agent25.7US$0.493.81 分钟21,622
编码37.8US$0.192.97 分钟16,820
金融与会计32.3US$0.232.31 分钟13,109
战略与咨询33.1US$0.322.62 分钟14,839
法律35.2US$0.191.93 分钟10,948
医疗27.9US$0.202.01 分钟11,417
工程38.6US$0.202.47 分钟14,004
经济学41.2US$0.161.96 分钟11,146

FAQ

GPT-5 常见问题

问题顺序参考公开搜索联想;回答只使用本页可核对的来源数据。

GPT-5 什么时候发布?

Artificial Analysis 当前记录的发布日期为 2025-08-07;本站按来源快照展示,不把发布前预测当作事实。

GPT-5 API 价格是多少?

当前没有精确同款的已核实 API 报价;本站上次记录的 Artificial Analysis model aggregate 数据为输入 US$1.25、输出 US$10(2026-07-21),仅作历史参考。

GPT-5 的评测表现怎么样?

公开 Intelligence Index v4.3 为 23.0,该数值为估算值。观测于 2026-09-09T14:00:04.717Z。不同方法版本不直接比较,不等于所有任务中的统一胜率。

GPT-5 的上下文窗口有多大?

上下文窗口为 400,000 Token;窗口上限不代表模型在全长度上始终保持相同的检索与推理质量。

GPT-5 的生成速度是多少?

公开性能数据为 101.1 Token/s,来源为 OpenAI。

GPT-5 是开源模型吗?

当前Artificial Analysis未提供可核验的开放权重,本站暂按非开放权重处理。

怎样通过 API 使用 GPT-5?

原始来源记录了 2 家 Provider。 Provider 横向明细尚未同步。