GLM-5.3-Flash

GLM-5.3-Flash

zai-org/GLM-5.3-Flash

Acerca de GLM-5.3-Flash

Un modelo de frontera diseñado para una codificación eficiente y tareas de agente de largo horizonte. Cuenta con comprensión Multimodal y una ventana de contexto completa de 1M de tokens, lo que le permite navegar por bases de código masivas, resolver problemas complejos y ejecutar flujos de trabajo de agente avanzados.

Serverless disponible

Ejecute consultas de forma inmediata y pague solo por el uso

Precio de Input

$

0.15

/ M Tokens

Lectura de caché

$

0.03

/ M Tokens

Precio de Output

$

0.5

/ M Tokens

Metadatos

Creado el

Licencia

MIT

Proveedor

Z.ai

HuggingFace

Especificación

Estado

Available

Arquitectura

Hybrid MoE

Calibrado

No

Mezcla de expertos

Parámetros totales

320B

Parámetros activados

18B

Razonamiento

No

Precisión

FP8

Longitud del contexto

1049K

Tokens máximos

262K

Funcionalidades admitidas

Serverless

Compatible

Serverless LoRA

No compatible

Ajuste fino

No compatible

Embeddings

No compatible

Rerankers

No compatible

Soporte para Input de Image

Compatible

JSON Mode

Compatible

Outputs estructuradas

No compatible

Herramientas

Compatible

Finalización de Fim

No compatible

Completado de prefijo de Chat

No compatible

¿Listo para acelerar tu desarrollo de IA?

¿Listo para acelerar tu desarrollo de IA?

¿Listo para acelerar tu desarrollo de IA?

© 2026 SiliconFlow

© 2026 SiliconFlow

© 2026 SiliconFlow