MODEL PROVIDERS

Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) API Provider 比较

比较 Claude Fable 5 (Adaptive Reasoning, Max Effort, Opus 4.8 Fallback) 在 3 家 API Provider 上的价格、任务成本、输出速度、延迟和端到端响应。数据来自公开实测,不修改原始数值。

数据快照:2026-09-19查看原始来源 ↗
已测 Provider3Anthropic、Google、Azure
输出最快69.9Azure · Token/s
首 Token 最快79.9Anthropic · 秒
单任务成本最低$3.14Anthropic
API 混合价最低$7.70Anthropic · 每 1M Token

怎样读这页

同一个模型经不同 Provider 托管时,模型能力通常不变,但价格、限流、输出速度和首字延迟会不同。实时聊天优先看延迟,批处理优先看成本与吞吐,长上下文任务还要单独看对应提示类型。

本页的“输出速度”指开始生成后的 Token/s;“首个回答 Token”指从请求到可见回答的等待;“端到端响应”按输出 500 Token 计算,三者不是同一指标。

API PRICE

Provider API 价格

混合价按 7:2:1 的缓存读取、输入和输出 Token 比例计算,便于同口径比较。

每 1M Token 的 7:2:1 混合价
每 1M Token 的 7:2:1 混合价;公开数据014 美元Anthropic: 7.7 美元;7:2:1 混合价Anthropic7.7 美元Google: 7.7 美元;7:2:1 混合价Google7.7 美元Azure: 14 美元;7:2:1 混合价Azure14 美元
查看图表数据
项目数值
Anthropic7.7 美元
Google7.7 美元
Azure14 美元

COST PER TASK

单次 Intelligence 任务成本

该值来自统一公开任务集的实际 Token 使用,不等于简单的 API 输入标价。

Provider 单任务成本
Provider 单任务成本;公开数据010.16 美元Anthropic: 3.14 美元Anthropic3.14 美元Google: 3.32 美元Google3.32 美元Azure: 10.16 美元Azure10.16 美元
查看图表数据
项目数值
Anthropic3.14 美元
Google3.32 美元
Azure10.16 美元

SPEED VS PRICE

速度与价格的权衡

更靠左代表价格更低,更靠上代表输出更快;高亮点为当前输出最快 Provider。

Provider 输出速度 vs API 混合价
Provider 输出速度 vs API 混合价API 混合价 / 1M Token输出速度7.7 美元14 美元69.9 Token/s64.9 Token/sAnthropic: API 混合价 / 1M Token 7.7 美元;输出速度 64.859 Token/sGoogle: API 混合价 / 1M Token 7.7 美元;输出速度 68.567 Token/sAzure: API 混合价 / 1M Token 14 美元;输出速度 69.895 Token/sAzure

Azure:API 混合价 / 1M Token 14 美元,输出速度 69.895 Token/s

查看图表数据
项目API 混合价 / 1M Token输出速度
Anthropic7.7 美元64.859 Token/s
Google7.7 美元68.567 Token/s
Azure14 美元69.895 Token/s

OUTPUT SPEED

回答生成速度

中位输出速度之外,同时在图表说明中保留 P05–P95 范围,避免只看单点。

Provider 输出速度中位数
Provider 输出速度中位数;公开数据069.9 Token/sAzure: 69.9 Token/s;P05–P95 48.1–94.9Azure69.9 Token/sGoogle: 68.6 Token/s;P05–P95 51.2–81.1Google68.6 Token/sAnthropic: 64.9 Token/s;P05–P95 49.3–78.9Anthropic64.9 Token/s
查看图表数据
项目数值
Azure69.9 Token/s
Google68.6 Token/s
Anthropic64.9 Token/s

LATENCY

首个回答 Token 等待

数值越低越适合实时交互;P05–P95 能反映请求抖动。

Provider 首个回答 Token 延迟
Provider 首个回答 Token 延迟;公开数据099.9 秒Anthropic: 79.9 秒;P05–P95 46.8–243.3 秒Anthropic79.9 秒Azure: 83.3 秒;P05–P95 46.0–270.4 秒Azure83.3 秒Google: 99.9 秒;P05–P95 44.0–248.1 秒Google99.9 秒
查看图表数据
项目数值
Anthropic79.9 秒
Azure83.3 秒
Google99.9 秒

END-TO-END RESPONSE

端到端响应时间

按 500 个输出 Token 计算,拆分输入处理、内部推理和文本生成。

Provider 端到端响应构成
输入处理推理生成 500 Token
Provider 端到端响应构成Anthropic: 87.6 秒Anthropic87.6 秒Azure: 90.4 秒Azure90.4 秒Google: 107.2 秒Google107.2 秒
查看图表数据
项目合计输入处理推理生成 500 Token
Anthropic87.6 秒79.9 秒0 秒7.7 秒
Azure90.4 秒83.3 秒0 秒7.2 秒
Google107.2 秒99.9 秒0 秒7.3 秒

PROMPT TYPES

不同任务类型下的表现

中等文本、长文本、编码、视觉、并行与 100K 上下文的数据分开呈现,避免用单一中位数替代真实场景。

各任务类型输出速度
各任务类型输出速度;公开数据071.9 Token/s中等文本 · Anthropic: 71 Token/s中等文本 · Anthropic71 Token/s中等文本 · Google: 71.9 Token/s中等文本 · Google71.9 Token/s中等文本 · Azure: 68.7 Token/s中等文本 · Azure68.7 Token/s长文本 · Anthropic: 64.9 Token/s长文本 · Anthropic64.9 Token/s长文本 · Google: 68.6 Token/s长文本 · Google68.6 Token/s长文本 · Azure: 69.9 Token/s长文本 · Azure69.9 Token/s100K 上下文 · Anthropic: 69 Token/s100K 上下文 · Anthropic69 Token/s100K 上下文 · Google: 64.7 Token/s100K 上下文 · Google64.7 Token/s100K 上下文 · Azure: 55.9 Token/s100K 上下文 · Azure55.9 Token/s单图视觉 · Anthropic: 38.2 Token/s单图视觉 · Anthropic38.2 Token/s单图视觉 · Google: 40 Token/s单图视觉 · Google40 Token/s单图视觉 · Azure: 39 Token/s单图视觉 · Azure39 Token/s并行请求 · Anthropic: 65.9 Token/s并行请求 · Anthropic65.9 Token/s并行请求 · Google: 69.3 Token/s并行请求 · Google69.3 Token/s并行请求 · Azure: 67.7 Token/s并行请求 · Azure67.7 Token/s
查看图表数据
项目数值
中等文本 · Anthropic71 Token/s
中等文本 · Google71.9 Token/s
中等文本 · Azure68.7 Token/s
长文本 · Anthropic64.9 Token/s
长文本 · Google68.6 Token/s
长文本 · Azure69.9 Token/s
100K 上下文 · Anthropic69 Token/s
100K 上下文 · Google64.7 Token/s
100K 上下文 · Azure55.9 Token/s
单图视觉 · Anthropic38.2 Token/s
单图视觉 · Google40 Token/s
单图视觉 · Azure39 Token/s
并行请求 · Anthropic65.9 Token/s
并行请求 · Google69.3 Token/s
并行请求 · Azure67.7 Token/s
各任务类型首块响应
各任务类型首块响应;公开数据0227.5 秒中等文本 · Anthropic: 51.6 秒中等文本 · Anthropic51.6 秒中等文本 · Google: 54.8 秒中等文本 · Google54.8 秒中等文本 · Azure: 52.6 秒中等文本 · Azure52.6 秒长文本 · Anthropic: 79.9 秒长文本 · Anthropic79.9 秒长文本 · Google: 99.9 秒长文本 · Google99.9 秒长文本 · Azure: 83.3 秒长文本 · Azure83.3 秒100K 上下文 · Anthropic: 203.4 秒100K 上下文 · Anthropic203.4 秒100K 上下文 · Google: 227.5 秒100K 上下文 · Google227.5 秒100K 上下文 · Azure: 156.4 秒100K 上下文 · Azure156.4 秒单图视觉 · Anthropic: 8.7 秒单图视觉 · Anthropic8.7 秒单图视觉 · Google: 8.9 秒单图视觉 · Google8.9 秒单图视觉 · Azure: 9.3 秒单图视觉 · Azure9.3 秒并行请求 · Anthropic: 45.9 秒并行请求 · Anthropic45.9 秒并行请求 · Google: 53.1 秒并行请求 · Google53.1 秒并行请求 · Azure: 64.4 秒并行请求 · Azure64.4 秒
查看图表数据
项目数值
中等文本 · Anthropic51.6 秒
中等文本 · Google54.8 秒
中等文本 · Azure52.6 秒
长文本 · Anthropic79.9 秒
长文本 · Google99.9 秒
长文本 · Azure83.3 秒
100K 上下文 · Anthropic203.4 秒
100K 上下文 · Google227.5 秒
100K 上下文 · Azure156.4 秒
单图视觉 · Anthropic8.7 秒
单图视觉 · Google8.9 秒
单图视觉 · Azure9.3 秒
并行请求 · Anthropic45.9 秒
并行请求 · Google53.1 秒
并行请求 · Azure64.4 秒
各任务类型端到端响应
各任务类型端到端响应;公开数据0235.3 秒中等文本 · Anthropic: 58.6 秒中等文本 · Anthropic58.6 秒中等文本 · Google: 61.8 秒中等文本 · Google61.8 秒中等文本 · Azure: 59.9 秒中等文本 · Azure59.9 秒长文本 · Anthropic: 87.6 秒长文本 · Anthropic87.6 秒长文本 · Google: 107.2 秒长文本 · Google107.2 秒长文本 · Azure: 90.4 秒长文本 · Azure90.4 秒100K 上下文 · Anthropic: 210.6 秒100K 上下文 · Anthropic210.6 秒100K 上下文 · Google: 235.3 秒100K 上下文 · Google235.3 秒100K 上下文 · Azure: 165.3 秒100K 上下文 · Azure165.3 秒单图视觉 · Anthropic: 21.8 秒单图视觉 · Anthropic21.8 秒单图视觉 · Google: 21.5 秒单图视觉 · Google21.5 秒单图视觉 · Azure: 22.2 秒单图视觉 · Azure22.2 秒并行请求 · Anthropic: 53.5 秒并行请求 · Anthropic53.5 秒并行请求 · Google: 60.3 秒并行请求 · Google60.3 秒并行请求 · Azure: 71.8 秒并行请求 · Azure71.8 秒
查看图表数据
项目数值
中等文本 · Anthropic58.6 秒
中等文本 · Google61.8 秒
中等文本 · Azure59.9 秒
长文本 · Anthropic87.6 秒
长文本 · Google107.2 秒
长文本 · Azure90.4 秒
100K 上下文 · Anthropic210.6 秒
100K 上下文 · Google235.3 秒
100K 上下文 · Azure165.3 秒
单图视觉 · Anthropic21.8 秒
单图视觉 · Google21.5 秒
单图视觉 · Azure22.2 秒
并行请求 · Anthropic53.5 秒
并行请求 · Google60.3 秒
并行请求 · Azure71.8 秒

FULL DATA

Provider 完整对照表

图表用于观察关系,表格保留精确数值,便于检索、引用和 AI 系统读取。

Claude Fable 5 Provider 完整数据
Provider输入 / 1M输出 / 1M缓存命中 / 1M7:2:1 混合价单任务成本输出速度速度 P05–P95首 Token延迟 P05–P95端到端上下文函数调用OpenAI 兼容
Anthropic ↗$10.00$50.00$1.00$7.70$3.1464.9 Token/s49.3–78.979.9 秒46.8–243.3 秒87.6 秒1,000,000支持支持
Google ↗$10.00$50.00$1.00$7.70$3.3268.6 Token/s51.2–81.199.9 秒44.0–248.1 秒107.2 秒1,000,000支持支持
Microsoft Azure ↗$10.00$50.00$14.00$10.1669.9 Token/s48.1–94.983.3 秒46.0–270.4 秒90.4 秒1,000,000支持支持

FAQ

常见问题

回答由本页结构化公开数据生成。

Claude Fable 5 有哪些 API Provider?

当前公开数据包含 Anthropic、Google、Azure,共 3 家。

哪家 Provider 输出最快?

Azure 的中位输出速度最高,为 69.9 Token/s。

哪家 Provider 延迟最低?

Anthropic 的首个回答 Token 中位等待最低,为 79.9 秒。

哪家 Provider 单任务成本最低?

Anthropic 最低,为 US$3.14。

为什么同一个模型速度不同?

Provider 的推理硬件、批处理、路由、负载和服务配置不同,因此相同模型的吞吐和延迟会出现差异。