

Comparación de modelos
GLM-4.6V
contra
Qwen2.5-VL-72B-Instruct

Precios
Input
$
0.3
/ M Tokens
$
0.59
/ M Tokens
Output
$
0.9
/ M Tokens
$
0.59
/ M Tokens
Metadatos
Especificación
Estado
Deprecated
Deprecated
Arquitectura
Multimodal MoE
Vision-Language Transformer
Calibrado
Sí
No
Mezcla de expertos
Sí
No
Parámetros totales
106B
72B
Parámetros activados
106B
72B
Razonamiento
No
No
Precisión
FP8
FP8
Longitud del contexto
131K
131K
Tokens máximos
131K
4K
Funcionalidades admitidas
Serverless
Compatible
Compatible
Serverless LoRA
No compatible
No compatible
Ajuste fino
No compatible
No compatible
Embeddings
No compatible
No compatible
Rerankers
No compatible
No compatible
Soporte para Input de Image
No compatible
No compatible
JSON Mode
No compatible
No compatible
Outputs estructuradas
No compatible
No compatible
Herramientas
Compatible
No compatible
Finalización de Fim
No compatible
No compatible
Completado de prefijo de Chat
No compatible
Compatible
GLM-4.6V en comparación
Ver cómo GLM-4.6V se compara con otros modelos populares en dimensiones clave.
vs.

GLM-5.1
vs.

Qwen3.5-122B-A10B
vs.

Qwen3.5-397B-A17B
vs.

MiniMax-M2.5
vs.

GLM-5
vs.

Step-3.5-Flash
vs.

GLM-4.7
vs.

MiniMax-M2.1
vs.

MiniMax-M2
vs.

Qwen3-VL-32B-Instruct
vs.

Qwen3-VL-32B-Thinking
vs.

Qwen3-VL-30B-A3B-Instruct
vs.

Qwen3-VL-30B-A3B-Thinking
vs.

Qwen3-VL-235B-A22B-Instruct
vs.

Qwen3-VL-235B-A22B-Thinking
vs.

Qwen3-Omni-30B-A3B-Instruct
vs.

Ring-flash-2.0
vs.

Ling-flash-2.0
vs.

Qwen3-Omni-30B-A3B-Captioner
vs.

Qwen3-Omni-30B-A3B-Thinking
