GLM-5.3-Flash
Acerca de GLM-5.3-Flash
Un modelo de frontera diseñado para una codificación eficiente y tareas de agente de largo horizonte. Cuenta con comprensión Multimodal y una ventana de contexto completa de 1M de tokens, lo que le permite navegar por bases de código masivas, resolver problemas complejos y ejecutar flujos de trabajo de agente avanzados.
Serverless disponible
Ejecute consultas de forma inmediata y pague solo por el uso
Precio de Input
$
0.15
/ M Tokens
Lectura de caché
$
0.03
/ M Tokens
Precio de Output
$
0.5
/ M Tokens
Metadatos
Especificación
Estado
Available
Arquitectura
Hybrid MoE
Calibrado
No
Mezcla de expertos
Sí
Parámetros totales
320B
Parámetros activados
18B
Razonamiento
No
Precisión
FP8
Longitud del contexto
1049K
Tokens máximos
262K
Funcionalidades admitidas
Serverless
Compatible
Serverless LoRA
No compatible
Ajuste fino
No compatible
Embeddings
No compatible
Rerankers
No compatible
Soporte para Input de Image
Compatible
JSON Mode
Compatible
Outputs estructuradas
No compatible
Herramientas
Compatible
Finalización de Fim
No compatible
Completado de prefijo de Chat
No compatible
Comparar con otros modelos
Descubre cómo se compara este modelo con otros.

Z.ai
GLM-4.7
Contexto total:
205K
Output máx.:
205K
Input:
$
0.42
/ M Tokens
Output:
$
2.2
/ M Tokens

Z.ai
chat
GLM-4.6V
Contexto total:
131K
Output máx.:
131K
Input:
$
0.3
/ M Tokens
Output:
$
0.9
/ M Tokens

Z.ai
chat
GLM-4.6
Contexto total:
205K
Output máx.:
205K
Input:
$
0.39
/ M Tokens
Output:
$
1.9
/ M Tokens

Z.ai
chat
GLM-4.5-Air
Contexto total:
131K
Output máx.:
131K
Input:
$
0.14
/ M Tokens
Output:
$
0.86
/ M Tokens

Z.ai
chat
GLM-4.5V
Contexto total:
66K
Output máx.:
66K
Input:
$
0.14
/ M Tokens
Output:
$
0.86
/ M Tokens

Z.ai
chat
GLM-4.1V-9B-Thinking
Contexto total:
66K
Output máx.:
66K
Input:
$
0.035
/ M Tokens
Output:
$
0.14
/ M Tokens

Z.ai
chat
GLM-Z1-32B-0414
Contexto total:
131K
Output máx.:
131K
Input:
$
0.14
/ M Tokens
Output:
$
0.57
/ M Tokens

Z.ai
chat
GLM-4-32B-0414
Contexto total:
33K
Output máx.:
33K
Input:
$
0.27
/ M Tokens
Output:
$
0.27
/ M Tokens

Z.ai
chat
GLM-Z1-9B-0414
Contexto total:
131K
Output máx.:
131K
Input:
$
0.086
/ M Tokens
Output:
$
0.086
/ M Tokens
