Comparación de modelos

Qwen2.5-Coder-32B-Instruct

contra

Qwen3-VL-30B-A3B-Instruct

Precios

Input

$

0.18

/ M Tokens

$

0.29

/ M Tokens

Output

$

0.18

/ M Tokens

$

1.0

/ M Tokens

Metadatos

Creado el

Licencia

APACHE-2.0

APACHE-2.0

Proveedor

Qwen

Qwen

Especificación

Estado

Deprecated

Available

Arquitectura

Causal Transformer

Vision-Language MoE

Calibrado

No

No

Mezcla de expertos

No

Parámetros totales

32B

30B

Parámetros activados

32.5B

3B

Razonamiento

No

No

Precisión

FP8

FP8

Longitud del contexto

33K

262K

Tokens máximos

4K

262K

Funcionalidades admitidas

Serverless

Compatible

Compatible

Serverless LoRA

No compatible

No compatible

Ajuste fino

No compatible

No compatible

Embeddings

No compatible

No compatible

Rerankers

No compatible

No compatible

Soporte para Input de Image

No compatible

No compatible

JSON Mode

Compatible

Compatible

Outputs estructuradas

No compatible

No compatible

Herramientas

No compatible

Compatible

Finalización de Fim

Compatible

Compatible

Completado de prefijo de Chat

Compatible

Compatible

¿Listo para acelerar tu desarrollo de IA?

¿Listo para acelerar tu desarrollo de IA?

¿Listo para acelerar tu desarrollo de IA?

© 2026 SiliconFlow

© 2026 SiliconFlow

© 2026 SiliconFlow