MODEL ANALYSIS
GPT-5.4 nano (medium)
GPT-5.4 nano (medium)(OpenAI)公开数据详情:智能指数 20.0(v4.3)、生成速度 171.6 Token/s、上下文 400,000 Token。评测来源 Artificial Analysis;规格来源 Artificial Analysis,快照 2026-09-19;各字段保留原始来源与观测时间。
评测按字段保留来源版本与观测时间。Intelligence Index v4.3 观测于 2026-09-09T14:00:04.717Z。 单任务成本、Token 与完整评测成本仍为此前快照参考,不代表新版评测或当前 API 报价。详情可在指标历史核对。
模型概览
GPT-5.4 nano (medium) 的 Intelligence Index v4.3 为 20.0(估算值),生成速度为 171.6 Token/s,历史完整评测成本为 暂无数据。这些指标分别反映能力、吞吐和评测经济性;旧成本未与新版指数绑定,不能合并成单一“最好”结论。
技术规格
- 机构
- OpenAI
- 发布日期
- 2026-03-17
- 推理类型
- 推理模型
- 模型权重
- 未开放权重
- 上下文窗口
- 400,000 Token
- 输入模态
- 文本、图像
- 输出模态
- 文本
- 性能来源
- OpenAI
INTERACTIVE COMPARISON
模型指标比较器
切换指标并按状态、推理类型和权重开放性筛选。首屏服务端呈现前 24 个模型,浏览器随后载入完整数据;历史参考配置可在“历史”或“全部”中查看。
仅比较 v4.3 同版本观测;不跨方法版本排序。估算指数保留来源的暂定性质。
- Claude Fable 549.7
- GLM-5.344.9
- Grok 4.6 (high)44.4
- Grok 4.6 (xhigh)44.3
INTELLIGENCE
Artificial Analysis 智能指数 · v4.3
v4.3 按 Agent、编码、通用与科学推理四类能力组合。仅在同版本内比较;数值越高越好。本页配置原观测于 2026-09-09T14:00:04.717Z。蓝色代表当前模型。
查看图表数据
INTELLIGENCE BREAKDOWN
组成评测 · v4.3
仅展示该版本逐项核实的原始指标;缺少同版本观测的字段不从历史回填。Elo、指数与通过率不能当作同一量纲排序;幻觉率越低越好。
| 指标 | 原始成绩 |
|---|---|
| AA-Omniscience 准确率 | 21.9% |
| AA-Omniscience 幻觉率(越低越好) | 51.1% |
| AA-LCR v1.1 | 67.3% |
| Humanity's Last Exam | 15.9% |
| CritPt | 5.1% |
AA-OMNISCIENCE
知识与幻觉
指数同时考虑正确回答和避免幻觉。当前模型准确率 21.9%,幻觉率 51.1%。
查看图表数据
CONTEXT WINDOW
上下文窗口
上下文窗口表示单次请求可处理的最大 Token 数,不代表模型一定能在全窗口内保持同等检索质量。
查看图表数据
| 项目 | 数值 |
|---|---|
| Llama 4 Scout | 10,000,000 Token |
| Muse Spark 1.2 (xhigh) | 1,048,576 Token |
| Kimi K3 (low) | 1,048,576 Token |
| Solar Open2 250B | 1,048,576 Token |
| Kimi K3 (max) | 1,048,576 Token |
| MiMo-V2.5-Pro | 1,000,000 Token |
| Nova 2.0 Omni (medium) | 1,000,000 Token |
| Gemini 3.5 Flash (minimal) | 1,000,000 Token |
| GPT-5.6 Luna (low) | 1,000,000 Token |
| GPT-5.6 Sol (low) | 1,000,000 Token |
| Gemini 3.5 Flash-Lite | 1,000,000 Token |
| Inkling | 1,000,000 Token |
| Claude Opus 5 (xhigh) | 1,000,000 Token |
| Claude Sonnet 5 (low) | 1,000,000 Token |
| GLM-5.3-Flash | 1,000,000 Token |
| Nova 2.0 Omni | 1,000,000 Token |
| Claude Opus 5 (low) | 1,000,000 Token |
| MiMo-V2.5 | 1,000,000 Token |
| Nemotron 3 Nano | 1,000,000 Token |
| Claude Sonnet 5 (max) | 1,000,000 Token |
OUTPUT SPEED
回答生成速度
模型开始输出后每秒生成的 Token;不包含开始回答前的等待时间。
查看图表数据
| 项目 | 数值 |
|---|---|
| Celeris-1 | 1,574.3 Token/s |
| Mercury 2 | 1,004.5 Token/s |
| Ling 3.0 Flash | 385.3 Token/s |
| HyperNova 60B 2605 | 365.7 Token/s |
| LFM2.5-VL-1.6B | 359 Token/s |
| Gemini 3.5 Flash-Lite | 352.7 Token/s |
| LFM2.5-8B-A1B | 338.6 Token/s |
| Nemotron 3 Nano Omni 30B A3B | 327.6 Token/s |
| Gemini 3.7 Flash (high) | 321.9 Token/s |
| Gemini 3.7 Flash (low) | 319.6 Token/s |
| Gemini 3.7 Flash (medium) | 318.2 Token/s |
| Nova Micro | 306.7 Token/s |
| Nemotron 3.5 Lightning | 293.2 Token/s |
| Command A+ | 268.8 Token/s |
| Qwen3.5 Omni Flash | 249.9 Token/s |
| DeepSeek V4 Flash | 232.3 Token/s |
| Nemotron 3 Nano | 221.7 Token/s |
| Granite 4.2 3B | 219.8 Token/s |
| Nemotron 3 Nano | 218.7 Token/s |
| NVIDIA Nemotron Nano 9B V2 | 203.9 Token/s |
查看图表数据
| 项目 | 数值 |
|---|---|
| Celeris-1 | 9 秒 |
| Llama 4 Scout | 10 秒 |
| GPT-5.5 Instant (June 2026) | 17.4 秒 |
| gpt-oss-120b (low) | 19 秒 |
| GPT-5.6 Luna (Non-reasoning) | 20.8 秒 |
| GPT-5.6 Luna (low) | 22.4 秒 |
| Llama 4 Maverick | 23 秒 |
| GPT-5.6 Terra (low) | 24 秒 |
| GPT-5.6 Terra (Non-reasoning) | 24.3 秒 |
| Mercury 2 | 28.1 秒 |
| GPT-5.6 Sol (Non-reasoning) | 33.7 秒 |
| GPT-5.6 Luna (medium) | 35.1 秒 |
| GPT-5.6 Sol (low) | 37.9 秒 |
| Gemini 3.5 Flash-Lite | 38.4 秒 |
| Gemini 3.7 Flash (low) | 42.5 秒 |
| GPT-5.6 Terra (medium) | 44.3 秒 |
| Devstral Small 2 | 47.6 秒 |
| Granite 4.2 3B | 52.7 秒 |
| Gemma 4 31B | 57.2 秒 |
| Qwen3.5 122B A10B | 60.9 秒 |
LATENCY
首个回答 Token 等待
推理模型的等待时间可能包含内部推理;低延迟更适合实时交互。
查看图表数据
| 项目 | 合计 | 输入处理 | 推理等待 |
|---|---|---|---|
| Celeris-1 | 0.6 秒 | 0.6 秒 | 0 秒 |
| Ministral 3 3B | 0.6 秒 | 0.6 秒 | 0 秒 |
| DeepSeek V4 Flash | 0.7 秒 | 0.7 秒 | 0 秒 |
| Qwen3.5 4B | 0.7 秒 | 0.7 秒 | 0 秒 |
| Gemma 4 E4B | 0.7 秒 | 0.7 秒 | 0 秒 |
| Grok 4.3 (Non-reasoning) | 0.7 秒 | 0.7 秒 | 0 秒 |
| Granite 4.1 8B | 0.8 秒 | 0.8 秒 | 0 秒 |
| Llama 4 Scout | 0.8 秒 | 0.8 秒 | 0 秒 |
| Ministral 3 8B | 0.8 秒 | 0.8 秒 | 0 秒 |
| GPT-5.4 nano | 4.2 秒 | 4.2 秒 | 0 秒 |
END-TO-END RESPONSE TIME
端到端响应时间
按收到 500 个输出 Token 计算,合计输入处理、推理和文本生成时间。
查看图表数据
| 项目 | 合计 | 输入处理 | 推理 | 生成 500 Token |
|---|---|---|---|---|
| Celeris-1 | 0.9 秒 | 0.6 秒 | 0 秒 | 0.3 秒 |
| Nova Micro | 2.5 秒 | 0.8 秒 | 0 秒 | 1.6 秒 |
| Gemini 3.7 Flash (low) | 2.5 秒 | 1 秒 | 0 秒 | 1.6 秒 |
| LFM2.5-VL-1.6B | 2.7 秒 | 1.3 秒 | 0 秒 | 1.4 秒 |
| DeepSeek V4 Flash | 2.8 秒 | 2.8 秒 | 0 秒 | 0 秒 |
| Nemotron 3 Nano | 3.2 秒 | 0.9 秒 | 0 秒 | 2.3 秒 |
| Ministral 3 3B | 3.5 秒 | 0.6 秒 | 0 秒 | 2.9 秒 |
| Gemini 3.5 Flash (minimal) | 3.5 秒 | 0.9 秒 | 0 秒 | 2.6 秒 |
| Qwen3.5 Omni Flash | 3.8 秒 | 1.8 秒 | 0 秒 | 2 秒 |
| GPT-5.4 nano | 7.1 秒 | 4.2 秒 | 0 秒 | 2.9 秒 |
FAQ
GPT-5.4 nano 常见问题
问题顺序参考公开搜索联想;回答只使用本页可核对的来源数据。
GPT-5.4 nano 什么时候发布?
Artificial Analysis 当前记录的发布日期为 2026-03-17;本站按来源快照展示,不把发布前预测当作事实。
GPT-5.4 nano API 价格是多少?
当前没有精确同款的已核实 API 报价;本站上次记录的 Artificial Analysis model aggregate 数据为输入 US$0.2、输出 US$1.25(2026-07-21),仅作历史参考。
GPT-5.4 nano 的评测表现怎么样?
公开 Intelligence Index v4.3 为 20.0,该数值为估算值。观测于 2026-09-09T14:00:04.717Z。不同方法版本不直接比较,不等于所有任务中的统一胜率。
GPT-5.4 nano 的上下文窗口有多大?
上下文窗口为 400,000 Token;窗口上限不代表模型在全长度上始终保持相同的检索与推理质量。
GPT-5.4 nano 的生成速度是多少?
公开性能数据为 171.6 Token/s,来源为 OpenAI。
GPT-5.4 nano 是开源模型吗?
当前Artificial Analysis未提供可核验的开放权重,本站暂按非开放权重处理。
怎样通过 API 使用 GPT-5.4 nano?
原始来源记录了 1 家 Provider。 Provider 横向明细尚未同步。