模型

产品

定价

文档

博客

关于

联系

🎉 gemma-4-12B-it 可以在 SiliconFlow 上使用。现在就尝试吧。

模型

Qwen3-VL-8B-Instruct

Qwen3-VL-8B-Instruct

Qwen/Qwen3-VL-8B-Instruct

API 参考

关于Qwen3-VL-8B-Instruct

Qwen3-VL-8B-Instruct 是 Qwen3 系列的 Vision-语言模型，展示了在通用视觉理解、以视觉为中心的对话以及图像中多语言 Text 识别方面的强大能力。

可用的 Serverless

立即运行查询，仅按使用量付费

每 100 万 token（Input/Output）

0.18

/ M Tokens

每 100 万 token（Input/Output）

0.68

/ M Tokens

模型广场

API 使用

基准

用例

元数据

创建

2025年10月15日

许可证

APACHE-2.0

提供者

Qwen

HuggingFace

Qwen3-VL-8B-Instruct

规格

州

Available

建筑

Vision-Language Transformer

校准的

不

专家混合

不

总参数

激活的参数

推理

不

精度

FP8

上下文长度

262K

最大输出长度

262K

支持功能

Serverless

支持

Serverless LoRA

不支持

微调

不支持

Embeddings

不支持

Rerankers

不支持

支持 Image Input

支持

JSON Mode

支持

结构化Outputs

不支持

工具

支持

FIM 补全

不支持

对话前缀补全

支持

与其他模型进行比较

看看这个模型与其他模型相比表现如何。

Qwen

chat

Qwen3-VL-32B-Instruct

发行日期：2025年10月21日

上下文长度：

262K

最大输出长度：

262K

Input:

0.2

/ M Tokens

Output:

0.6

/ M Tokens

Qwen

chat

Qwen3-VL-32B-Thinking

发行日期：2025年10月21日

上下文长度：

262K

最大输出长度：

262K

Input:

0.2

/ M Tokens

Output:

1.5

/ M Tokens

Qwen

chat