MODEL ANALYSIS

Qwen3 VL 8B (Reasoning)

Qwen3 VL 8B (Reasoning)(Alibaba)公开数据详情:智能指数 8.2(v4.3)、生成速度 114.8 Token/s、上下文 256,000 Token。评测来源 Artificial Analysis;规格来源 Artificial Analysis,快照 2026-09-19;各字段保留原始来源与观测时间。

数据快照:2026-09-19查看原始来源 ↗
智能指数 · v4.38.2*暂无排名
生成速度114.8Token/s
API 价格当前 API 未核实 · Artificial Analysis model aggregate 历史输入 $0.18 / 输出 $2.1(2026-07-21)
单任务成本 · 历史参考来源未提供可比较价格
单任务输出 · 历史参考Token

评测按字段保留来源版本与观测时间。Intelligence Index v4.3 观测于 2026-09-09T14:00:04.717Z。 单任务成本、Token 与完整评测成本仍为此前快照参考,不代表新版评测或当前 API 报价。详情可在指标历史核对。

模型概览

Qwen3 VL 8B (Reasoning) 的 Intelligence Index v4.3 为 8.2(估算值),生成速度为 114.8 Token/s,历史完整评测成本为 暂无数据。这些指标分别反映能力、吞吐和评测经济性;旧成本未与新版指数绑定,不能合并成单一“最好”结论。

技术规格

机构
Alibaba
发布日期
2025-10-14
推理类型
推理模型
模型权重
开放权重
参数规模
8.77B
权重许可
Apache 2.0
上下文窗口
256,000 Token
输入模态
文本、图像
输出模态
文本
性能来源
Alibaba

INTERACTIVE COMPARISON

模型指标比较器

切换指标并按状态、推理类型和权重开放性筛选。首屏服务端呈现前 24 个模型,浏览器随后载入完整数据;历史参考配置可在“历史”或“全部”中查看。

23 / 653 个模型 · 正在载入全量数据

仅比较 v4.3 同版本观测;不跨方法版本排序。估算指数保留来源的暂定性质。

智能指数模型比较;当前显示 23 个模型。Claude Fable 5.1 (max with …53.4Claude Fable 5.1 (xhigh wit…53.2GPT-6 Astra (max)52.8GPT-6 Astra (xhigh)52.5Claude Fable 5.1 (high with…51.2GPT-6 Astra (high)51Claude Opus 5 (max)50.7Claude Fable 549.7GPT-6 Astra (medium)49.7Claude Opus 5 (xhigh)49.7Claude Fable 5.1 (medium wi…49.1Claude Opus 5 (high)48.2Muse Spark 1.3 (max)48.2GPT-5.6 Sol (max)47.1Claude Fable 5.1 (low with …47GPT-6 Astra (low)46Qwen3.8 Max (0902)45.4Muse Spark 1.3 (xhigh)45.2Claude Opus 5 (medium)45.1GLM-5.344.9Grok 4.6 (high)44.4Grok 4.6 (xhigh)44.3GPT-5.6 Sol (xhigh)44.1

INTELLIGENCE

Artificial Analysis 智能指数 · v4.3

v4.3 按 Agent、编码、通用与科学推理四类能力组合。仅在同版本内比较;数值越高越好。本页配置原观测于 2026-09-09T14:00:04.717Z。蓝色代表当前模型。

模型智能指数对比 · v4.3
模型智能指数对比 · v4.3;公开数据053.4Claude Fable 5.1 (max with fallback): 53.4;AnthropicClaude Fable 5.1 (max with fa…53.4Claude Fable 5.1 (xhigh with fallback): 53.2;AnthropicClaude Fable 5.1 (xhigh with …53.2GPT-6 Astra (max): 52.8;OpenAIGPT-6 Astra (max)52.8GPT-6 Astra (xhigh): 52.5;OpenAIGPT-6 Astra (xhigh)52.5Claude Fable 5.1 (high with fallback): 51.2;AnthropicClaude Fable 5.1 (high with f…51.2GPT-6 Astra (high): 51;OpenAIGPT-6 Astra (high)51Claude Opus 5 (max): 50.7;AnthropicClaude Opus 5 (max)50.7Claude Fable 5: 49.7;AnthropicClaude Fable 549.7GPT-6 Astra (medium): 49.7;OpenAIGPT-6 Astra (medium)49.7Claude Opus 5 (xhigh): 49.7;AnthropicClaude Opus 5 (xhigh)49.7Claude Fable 5.1 (medium with fallback): 49.1;AnthropicClaude Fable 5.1 (medium with…49.1Claude Opus 5 (high): 48.2;AnthropicClaude Opus 5 (high)48.2Muse Spark 1.3 (max): 48.2;MetaMuse Spark 1.3 (max)48.2GPT-5.6 Sol (max): 47.1;OpenAIGPT-5.6 Sol (max)47.1Claude Fable 5.1 (low with fallback): 47;AnthropicClaude Fable 5.1 (low with fa…47GPT-6 Astra (low): 46;OpenAIGPT-6 Astra (low)46Qwen3.8 Max (0902): 45.4;AlibabaQwen3.8 Max (0902)45.4Muse Spark 1.3 (xhigh): 45.2;MetaMuse Spark 1.3 (xhigh)45.2Claude Opus 5 (medium): 45.1;AnthropicClaude Opus 5 (medium)45.1GLM-5.3: 44.9;Z AIGLM-5.344.9
查看图表数据
项目数值
Claude Fable 5.1 (max with fallback)53.4
Claude Fable 5.1 (xhigh with fallback)53.2
GPT-6 Astra (max)52.8
GPT-6 Astra (xhigh)52.5
Claude Fable 5.1 (high with fallback)51.2
GPT-6 Astra (high)51
Claude Opus 5 (max)50.7
Claude Fable 549.7
GPT-6 Astra (medium)49.7
Claude Opus 5 (xhigh)49.7
Claude Fable 5.1 (medium with fallback)49.1
Claude Opus 5 (high)48.2
Muse Spark 1.3 (max)48.2
GPT-5.6 Sol (max)47.1
Claude Fable 5.1 (low with fallback)47
GPT-6 Astra (low)46
Qwen3.8 Max (0902)45.4
Muse Spark 1.3 (xhigh)45.2
Claude Opus 5 (medium)45.1
GLM-5.344.9

INTELLIGENCE BREAKDOWN

组成评测 · v4.3

仅展示该版本逐项核实的原始指标;缺少同版本观测的字段不从历史回填。Elo、指数与通过率不能当作同一量纲排序;幻觉率越低越好。

Qwen3 VL 8B (Reasoning) 的分项原始指标
指标原始成绩
AA-Omniscience 准确率20.4%
AA-Omniscience 幻觉率(越低越好)91.4%
AA-LCR v1.133.3%
Humanity's Last Exam3.8%
CritPt0.3%

AA-OMNISCIENCE

知识与幻觉

指数同时考虑正确回答和避免幻觉。当前模型准确率 20.4%,幻觉率 91.4%。

AA-Omniscience 指数对比
AA-Omniscience 指数对比;公开数据043.7GPT-6 Astra (high): 43.7;OpenAIGPT-6 Astra (high)43.7Claude Fable 5.1 (max with fallback): 43.5;AnthropicClaude Fable 5.1 (max with fa…43.5GPT-6 Astra (xhigh): 43.4;OpenAIGPT-6 Astra (xhigh)43.4GPT-6 Astra (max): 43.4;OpenAIGPT-6 Astra (max)43.4Claude Fable 5: 43.3;AnthropicClaude Fable 543.3Claude Fable 5.1 (xhigh with fallback): 42.4;AnthropicClaude Fable 5.1 (xhigh with …42.4GPT-6 Astra (medium): 42.2;OpenAIGPT-6 Astra (medium)42.2Claude Fable 5.1 (high with fallback): 40.8;AnthropicClaude Fable 5.1 (high with f…40.8GPT-6 Astra (low): 40.6;OpenAIGPT-6 Astra (low)40.6Claude Fable 5.1 (medium with fallback): 37.6;AnthropicClaude Fable 5.1 (medium with…37.6Claude Opus 5 (max): 37.1;AnthropicClaude Opus 5 (max)37.1Claude Opus 5 (xhigh): 35.4;AnthropicClaude Opus 5 (xhigh)35.4Claude Fable 5.1 (low with fallback): 34.1;AnthropicClaude Fable 5.1 (low with fa…34.1Claude Opus 5 (high): 33.7;AnthropicClaude Opus 5 (high)33.7Gemini 3.1 Pro Preview: 31.9;GoogleGemini 3.1 Pro Preview31.9Claude Opus 5 (medium): 31;AnthropicClaude Opus 5 (medium)31Grok 4.6 (high): 30.5;SpaceXAIGrok 4.6 (high)30.5Gemini 3.8 Flash (high): 29.6;GoogleGemini 3.8 Flash (high)29.6Grok 4.6 (xhigh): 29.3;SpaceXAIGrok 4.6 (xhigh)29.3Gemini 3.8 Flash (medium): 28.6;GoogleGemini 3.8 Flash (medium)28.6
查看图表数据
项目数值
GPT-6 Astra (high)43.7
Claude Fable 5.1 (max with fallback)43.5
GPT-6 Astra (xhigh)43.4
GPT-6 Astra (max)43.4
Claude Fable 543.3
Claude Fable 5.1 (xhigh with fallback)42.4
GPT-6 Astra (medium)42.2
Claude Fable 5.1 (high with fallback)40.8
GPT-6 Astra (low)40.6
Claude Fable 5.1 (medium with fallback)37.6
Claude Opus 5 (max)37.1
Claude Opus 5 (xhigh)35.4
Claude Fable 5.1 (low with fallback)34.1
Claude Opus 5 (high)33.7
Gemini 3.1 Pro Preview31.9
Claude Opus 5 (medium)31
Grok 4.6 (high)30.5
Gemini 3.8 Flash (high)29.6
Grok 4.6 (xhigh)29.3
Gemini 3.8 Flash (medium)28.6

CONTEXT WINDOW

上下文窗口

上下文窗口表示单次请求可处理的最大 Token 数,不代表模型一定能在全窗口内保持同等检索质量。

上下文窗口对比
上下文窗口对比;公开数据010,000,000 TokenLlama 4 Scout: 10,000,000 Token;MetaLlama 4 Scout10,000,000 TokenMuse Spark 1.2 (xhigh): 1,048,576 Token;MetaMuse Spark 1.2 (xhigh)1,048,576 TokenKimi K3 (low): 1,048,576 Token;KimiKimi K3 (low)1,048,576 TokenSolar Open2 250B: 1,048,576 Token;UpstageSolar Open2 250B1,048,576 TokenKimi K3 (max): 1,048,576 Token;KimiKimi K3 (max)1,048,576 TokenMiMo-V2.5-Pro: 1,000,000 Token;XiaomiMiMo-V2.5-Pro1,000,000 TokenNova 2.0 Omni (medium): 1,000,000 Token;AmazonNova 2.0 Omni (medium)1,000,000 TokenGemini 3.5 Flash (minimal): 1,000,000 Token;GoogleGemini 3.5 Flash (minimal)1,000,000 TokenGPT-5.6 Luna (low): 1,000,000 Token;OpenAIGPT-5.6 Luna (low)1,000,000 TokenGPT-5.6 Sol (low): 1,000,000 Token;OpenAIGPT-5.6 Sol (low)1,000,000 TokenGemini 3.5 Flash-Lite: 1,000,000 Token;GoogleGemini 3.5 Flash-Lite1,000,000 TokenInkling: 1,000,000 Token;Thinking MachinesInkling1,000,000 TokenClaude Opus 5 (xhigh): 1,000,000 Token;AnthropicClaude Opus 5 (xhigh)1,000,000 TokenClaude Sonnet 5 (low): 1,000,000 Token;AnthropicClaude Sonnet 5 (low)1,000,000 TokenGLM-5.3-Flash: 1,000,000 Token;Z AIGLM-5.3-Flash1,000,000 TokenNova 2.0 Omni: 1,000,000 Token;AmazonNova 2.0 Omni1,000,000 TokenClaude Opus 5 (low): 1,000,000 Token;AnthropicClaude Opus 5 (low)1,000,000 TokenMiMo-V2.5: 1,000,000 Token;XiaomiMiMo-V2.51,000,000 TokenNemotron 3 Nano: 1,000,000 Token;NVIDIANemotron 3 Nano1,000,000 TokenClaude Sonnet 5 (max): 1,000,000 Token;AnthropicClaude Sonnet 5 (max)1,000,000 Token
查看图表数据
项目数值
Llama 4 Scout10,000,000 Token
Muse Spark 1.2 (xhigh)1,048,576 Token
Kimi K3 (low)1,048,576 Token
Solar Open2 250B1,048,576 Token
Kimi K3 (max)1,048,576 Token
MiMo-V2.5-Pro1,000,000 Token
Nova 2.0 Omni (medium)1,000,000 Token
Gemini 3.5 Flash (minimal)1,000,000 Token
GPT-5.6 Luna (low)1,000,000 Token
GPT-5.6 Sol (low)1,000,000 Token
Gemini 3.5 Flash-Lite1,000,000 Token
Inkling1,000,000 Token
Claude Opus 5 (xhigh)1,000,000 Token
Claude Sonnet 5 (low)1,000,000 Token
GLM-5.3-Flash1,000,000 Token
Nova 2.0 Omni1,000,000 Token
Claude Opus 5 (low)1,000,000 Token
MiMo-V2.51,000,000 Token
Nemotron 3 Nano1,000,000 Token
Claude Sonnet 5 (max)1,000,000 Token

OUTPUT SPEED

回答生成速度

模型开始输出后每秒生成的 Token;不包含开始回答前的等待时间。

输出速度对比
输出速度对比;公开数据01,574.3 Token/sCeleris-1: 1,574.3 Token/s;CelerisCeleris-11,574.3 Token/sMercury 2: 1,004.5 Token/s;InceptionMercury 21,004.5 Token/sLing 3.0 Flash: 385.3 Token/s;InclusionAILing 3.0 Flash385.3 Token/sHyperNova 60B 2605: 365.7 Token/s;Multiverse ComputingHyperNova 60B 2605365.7 Token/sLFM2.5-VL-1.6B: 359 Token/s;Liquid AILFM2.5-VL-1.6B359 Token/sGemini 3.5 Flash-Lite: 352.7 Token/s;GoogleGemini 3.5 Flash-Lite352.7 Token/sLFM2.5-8B-A1B: 338.6 Token/s;Liquid AILFM2.5-8B-A1B338.6 Token/sNemotron 3 Nano Omni 30B A3B: 327.6 Token/s;NVIDIANemotron 3 Nano Omni 30B A3B327.6 Token/sGemini 3.7 Flash (high): 321.9 Token/s;GoogleGemini 3.7 Flash (high)321.9 Token/sGemini 3.7 Flash (low): 319.6 Token/s;GoogleGemini 3.7 Flash (low)319.6 Token/sGemini 3.7 Flash (medium): 318.2 Token/s;GoogleGemini 3.7 Flash (medium)318.2 Token/sNova Micro: 306.7 Token/s;AmazonNova Micro306.7 Token/sNemotron 3.5 Lightning: 293.2 Token/s;NVIDIANemotron 3.5 Lightning293.2 Token/sCommand A+: 268.8 Token/s;CohereCommand A+268.8 Token/sQwen3.5 Omni Flash: 249.9 Token/s;AlibabaQwen3.5 Omni Flash249.9 Token/sDeepSeek V4 Flash: 232.3 Token/s;DeepSeekDeepSeek V4 Flash232.3 Token/sNemotron 3 Nano: 221.7 Token/s;NVIDIANemotron 3 Nano221.7 Token/sGranite 4.2 3B: 219.8 Token/s;IBMGranite 4.2 3B219.8 Token/sNemotron 3 Nano: 218.7 Token/s;NVIDIANemotron 3 Nano218.7 Token/sNVIDIA Nemotron Nano 9B V2: 203.9 Token/s;NVIDIANVIDIA Nemotron Nano 9B V2203.9 Token/s
查看图表数据
项目数值
Celeris-11,574.3 Token/s
Mercury 21,004.5 Token/s
Ling 3.0 Flash385.3 Token/s
HyperNova 60B 2605365.7 Token/s
LFM2.5-VL-1.6B359 Token/s
Gemini 3.5 Flash-Lite352.7 Token/s
LFM2.5-8B-A1B338.6 Token/s
Nemotron 3 Nano Omni 30B A3B327.6 Token/s
Gemini 3.7 Flash (high)321.9 Token/s
Gemini 3.7 Flash (low)319.6 Token/s
Gemini 3.7 Flash (medium)318.2 Token/s
Nova Micro306.7 Token/s
Nemotron 3.5 Lightning293.2 Token/s
Command A+268.8 Token/s
Qwen3.5 Omni Flash249.9 Token/s
DeepSeek V4 Flash232.3 Token/s
Nemotron 3 Nano221.7 Token/s
Granite 4.2 3B219.8 Token/s
Nemotron 3 Nano218.7 Token/s
NVIDIA Nemotron Nano 9B V2203.9 Token/s
单次 Intelligence 任务耗时
单次 Intelligence 任务耗时;公开数据060.9 秒Celeris-1: 9 秒;CelerisCeleris-19 秒Llama 4 Scout: 10 秒;MetaLlama 4 Scout10 秒GPT-5.5 Instant (June 2026): 17.4 秒;OpenAIGPT-5.5 Instant (June 2026)17.4 秒gpt-oss-120b (low): 19 秒;OpenAIgpt-oss-120b (low)19 秒GPT-5.6 Luna (Non-reasoning): 20.8 秒;OpenAIGPT-5.6 Luna (Non-reasoning)20.8 秒GPT-5.6 Luna (low): 22.4 秒;OpenAIGPT-5.6 Luna (low)22.4 秒Llama 4 Maverick: 23 秒;MetaLlama 4 Maverick23 秒GPT-5.6 Terra (low): 24 秒;OpenAIGPT-5.6 Terra (low)24 秒GPT-5.6 Terra (Non-reasoning): 24.3 秒;OpenAIGPT-5.6 Terra (Non-reasoning)24.3 秒Mercury 2: 28.1 秒;InceptionMercury 228.1 秒GPT-5.6 Sol (Non-reasoning): 33.7 秒;OpenAIGPT-5.6 Sol (Non-reasoning)33.7 秒GPT-5.6 Luna (medium): 35.1 秒;OpenAIGPT-5.6 Luna (medium)35.1 秒GPT-5.6 Sol (low): 37.9 秒;OpenAIGPT-5.6 Sol (low)37.9 秒Gemini 3.5 Flash-Lite: 38.4 秒;GoogleGemini 3.5 Flash-Lite38.4 秒Gemini 3.7 Flash (low): 42.5 秒;GoogleGemini 3.7 Flash (low)42.5 秒GPT-5.6 Terra (medium): 44.3 秒;OpenAIGPT-5.6 Terra (medium)44.3 秒Devstral Small 2: 47.6 秒;MistralDevstral Small 247.6 秒Granite 4.2 3B: 52.7 秒;IBMGranite 4.2 3B52.7 秒Gemma 4 31B: 57.2 秒;GoogleGemma 4 31B57.2 秒Qwen3.5 122B A10B: 60.9 秒;AlibabaQwen3.5 122B A10B60.9 秒
查看图表数据
项目数值
Celeris-19 秒
Llama 4 Scout10 秒
GPT-5.5 Instant (June 2026)17.4 秒
gpt-oss-120b (low)19 秒
GPT-5.6 Luna (Non-reasoning)20.8 秒
GPT-5.6 Luna (low)22.4 秒
Llama 4 Maverick23 秒
GPT-5.6 Terra (low)24 秒
GPT-5.6 Terra (Non-reasoning)24.3 秒
Mercury 228.1 秒
GPT-5.6 Sol (Non-reasoning)33.7 秒
GPT-5.6 Luna (medium)35.1 秒
GPT-5.6 Sol (low)37.9 秒
Gemini 3.5 Flash-Lite38.4 秒
Gemini 3.7 Flash (low)42.5 秒
GPT-5.6 Terra (medium)44.3 秒
Devstral Small 247.6 秒
Granite 4.2 3B52.7 秒
Gemma 4 31B57.2 秒
Qwen3.5 122B A10B60.9 秒

LATENCY

首个回答 Token 等待

推理模型的等待时间可能包含内部推理;低延迟更适合实时交互。

首个回答 Token:输入处理与推理等待
输入处理推理等待
首个回答 Token:输入处理与推理等待Celeris-1: 0.6 秒Celeris-10.6 秒Ministral 3 3B: 0.6 秒Ministral 3 3B0.6 秒DeepSeek V4 Flash: 0.7 秒DeepSeek V4 Flash0.7 秒Qwen3.5 4B: 0.7 秒Qwen3.5 4B0.7 秒Gemma 4 E4B: 0.7 秒Gemma 4 E4B0.7 秒Grok 4.3 (Non-reasoning): 0.7 秒Grok 4.3 (Non-reasoning)0.7 秒Granite 4.1 8B: 0.8 秒Granite 4.1 8B0.8 秒Llama 4 Scout: 0.8 秒Llama 4 Scout0.8 秒Ministral 3 8B: 0.8 秒Ministral 3 8B0.8 秒Qwen3 VL 8B: 19.7 秒Qwen3 VL 8B19.7 秒
查看图表数据
项目合计输入处理推理等待
Celeris-10.6 秒0.6 秒0 秒
Ministral 3 3B0.6 秒0.6 秒0 秒
DeepSeek V4 Flash0.7 秒0.7 秒0 秒
Qwen3.5 4B0.7 秒0.7 秒0 秒
Gemma 4 E4B0.7 秒0.7 秒0 秒
Grok 4.3 (Non-reasoning)0.7 秒0.7 秒0 秒
Granite 4.1 8B0.8 秒0.8 秒0 秒
Llama 4 Scout0.8 秒0.8 秒0 秒
Ministral 3 8B0.8 秒0.8 秒0 秒
Qwen3 VL 8B19.7 秒2.3 秒17.4 秒

END-TO-END RESPONSE TIME

端到端响应时间

按收到 500 个输出 Token 计算,合计输入处理、推理和文本生成时间。

输出 500 Token 的完整响应时间
输入处理推理生成 500 Token
输出 500 Token 的完整响应时间Celeris-1: 0.9 秒Celeris-10.9 秒Nova Micro: 2.5 秒Nova Micro2.5 秒Gemini 3.7 Flash (low): 2.5 秒Gemini 3.7 Flash (low)2.5 秒LFM2.5-VL-1.6B: 2.7 秒LFM2.5-VL-1.6B2.7 秒DeepSeek V4 Flash: 2.8 秒DeepSeek V4 Flash2.8 秒Nemotron 3 Nano: 3.2 秒Nemotron 3 Nano3.2 秒Ministral 3 3B: 3.5 秒Ministral 3 3B3.5 秒Gemini 3.5 Flash (minimal): 3.5 秒Gemini 3.5 Flash (minimal)3.5 秒Qwen3.5 Omni Flash: 3.8 秒Qwen3.5 Omni Flash3.8 秒Qwen3 VL 8B: 24.1 秒Qwen3 VL 8B24.1 秒
查看图表数据
项目合计输入处理推理生成 500 Token
Celeris-10.9 秒0.6 秒0 秒0.3 秒
Nova Micro2.5 秒0.8 秒0 秒1.6 秒
Gemini 3.7 Flash (low)2.5 秒1 秒0 秒1.6 秒
LFM2.5-VL-1.6B2.7 秒1.3 秒0 秒1.4 秒
DeepSeek V4 Flash2.8 秒2.8 秒0 秒0 秒
Nemotron 3 Nano3.2 秒0.9 秒0 秒2.3 秒
Ministral 3 3B3.5 秒0.6 秒0 秒2.9 秒
Gemini 3.5 Flash (minimal)3.5 秒0.9 秒0 秒2.6 秒
Qwen3.5 Omni Flash3.8 秒1.8 秒0 秒2 秒
Qwen3 VL 8B24.1 秒2.3 秒17.4 秒4.4 秒

FAQ

Qwen3 VL 8B 常见问题

问题顺序参考公开搜索联想;回答只使用本页可核对的来源数据。

Qwen3 VL 8B 什么时候发布?

Artificial Analysis 当前记录的发布日期为 2025-10-14;本站按来源快照展示,不把发布前预测当作事实。

Qwen3 VL 8B API 价格是多少?

当前没有精确同款的已核实 API 报价;本站上次记录的 Artificial Analysis model aggregate 数据为输入 US$0.18、输出 US$2.1(2026-07-21),仅作历史参考。

Qwen3 VL 8B 的评测表现怎么样?

公开 Intelligence Index v4.3 为 8.2,该数值为估算值。观测于 2026-09-09T14:00:04.717Z。不同方法版本不直接比较,不等于所有任务中的统一胜率。

Qwen3 VL 8B 的上下文窗口有多大?

上下文窗口为 256,000 Token;窗口上限不代表模型在全长度上始终保持相同的检索与推理质量。

Qwen3 VL 8B 的生成速度是多少?

公开性能数据为 114.8 Token/s,来源为 Alibaba。

Qwen3 VL 8B 是开源模型吗?

更准确地说,这是开放权重模型,不等同于采用开源软件许可。来源记录的许可为 Apache 2.0,商业使用需按许可原文核对条件。

怎样通过 API 使用 Qwen3 VL 8B?

原始来源记录了 1 家 Provider。 Provider 横向明细尚未同步。