模型

产品

定价

文档

博客

关于

联系

🎉 gemma-4-12B-it 可以在 SiliconFlow 上使用。现在就尝试吧。

模型

Qwen3-VL-30B-A3B-Thinking

Qwen3-VL-30B-A3B-Thinking

Qwen/Qwen3-VL-30B-A3B-Thinking

API 参考

关于Qwen3-VL-30B-A3B-Thinking

Qwen3-VL系列提供卓越的Text理解与生成、更深入的视觉感知与推理、扩展的上下文长度、增强的空间和Video动态理解能力，以及更强的代理互动能力。可用的Dense和MoE架构从边缘到云端扩展，还有指导和推理增强的Thinking版本。

可用的 Serverless

立即运行查询，仅按使用量付费

每 100 万 token（Input/Output）

0.29

/ M Tokens

每 100 万 token（Input/Output）

1.0

/ M Tokens

模型广场

API 使用

基准

用例

元数据

创建

2025年10月11日

许可证

APACHE-2.0

提供者

Qwen

HuggingFace

Qwen3-VL-30B-A3B-Thinking

规格

州

Available

建筑

Multimodal MoE

校准的

不

专家混合

是

总参数

30B

激活的参数

30B

推理

不

精度

FP8

上下文长度

262K

最大输出长度

262K

支持功能

Serverless

支持

Serverless LoRA

不支持

微调

不支持

Embeddings

不支持

Rerankers

不支持

支持 Image Input

支持

JSON Mode

支持

结构化Outputs

不支持

工具

支持

FIM 补全

支持

对话前缀补全

支持

与其他模型进行比较

看看这个模型与其他模型相比表现如何。

Qwen

chat

Qwen3-VL-32B-Instruct

发行日期：2025年10月21日

上下文长度：

262K

最大输出长度：

262K

Input:

0.2

/ M Tokens

Output:

0.6

/ M Tokens

Qwen

chat

Qwen3-VL-32B-Thinking

发行日期：2025年10月21日

上下文长度：

262K

最大输出长度：

262K

Input:

0.2

/ M Tokens

Output:

1.5

/ M Tokens

Qwen

chat

Qwen3-VL-8B-Instruct

发行日期：2025年10月15日

上下文长度：

262K

最大输出长度：

262K

Input:

0.18

/ M Tokens

Output:

0.68

/ M Tokens

Qwen

chat

Qwen3-VL-8B-Thinking

发行日期：2025年10月15日

上下文长度：

262K

最大输出长度：

262K

Input:

0.18

/ M Tokens

Output:

2.0

/ M Tokens

Qwen

chat

Qwen3-VL-235B-A22B-Instruct

发行日期：2025年10月4日

上下文长度：

262K

最大输出长度：

262K

Input:

0.3

/ M Tokens

Output:

1.5

/ M Tokens

Qwen

chat

Qwen3-VL-235B-A22B-Thinking

发行日期：2025年10月4日

上下文长度：

262K

最大输出长度：

262K

Input:

0.45

/ M Tokens

Output:

3.5

/ M Tokens

Qwen

chat

Qwen3-VL-30B-A3B-Instruct

发行日期：2025年10月5日

上下文长度：

262K

最大输出长度：

262K

Input:

0.29

/ M Tokens

Output:

1.0

/ M Tokens

Qwen

chat