
Z.ai
Text Generation
GLM-4.7
GLM-4.7 es el modelo insignia de nueva generación de Zhipu, con un total de 355B de parámetros y 32B de parámetros activos, lo que ofrece mejoras integrales en conversación general, razonamiento y capacidades de agentes. Las respuestas son más concisas y naturales; la redacción se siente más inmersiva; las instrucciones de llamada a herramientas se siguen de manera más fiable; y se ha mejorado aún más el pulido de artefactos en el front-end y la programación con agentes, junto con la eficiencia en la ejecución de tareas de largo alcance....
Contexto total:
205K
Output máx.:
205K
Input:
$
0.42
/ M Tokens
Input almacenada en caché:
$
texto
/ M Tokens
Output:
$
2.2
/ M Tokens

Z.ai
Text Generation
GLM-4.5-Air
Los modelos de la serie GLM-4.5 son modelos fundacionales diseñados para agentes inteligentes. GLM-4.5-Air adopta un diseño más compacto con un total de 106.000 millones de parámetros y 12.000 millones de parámetros activos. También es un modelo de razonamiento híbrido que ofrece tanto el modo de pensamiento como el de no pensamiento....
Contexto total:
131K
Output máx.:
131K
Input:
$
0.14
/ M Tokens
Input almacenada en caché:
$
texto
/ M Tokens
Output:
$
0.86
/ M Tokens

Z.ai
Text Generation
GLM-5.2
GLM-5.2 es el modelo de código abierto más capaz de Z.ai hasta la fecha, diseñado para la ingeniería de agentes de largo alcance con una ventana de contexto de 1M de tokens que es verdaderamente utilizable. Mantiene intacto el estado del proyecto en tareas extremadamente largas, reduciendo la necesidad de comprimir o descartar el contexto: cuanto más larga es la tarea, más puede recordar y razonar....
Contexto total:
1049K
Output máx.:
262K
Input:
$
1.302
/ M Tokens
Input almacenada en caché:
$
texto
/ M Tokens
Output:
$
4.092
/ M Tokens

Z.ai
Text Generation
GLM-5.1
GLM-5.1 es el modelo insignia de próxima generación de Z.ai, creado para la ingeniería de agentes. Está diseñado para ejecutarse de forma continua durante horas o incluso más tiempo, perfeccionando su estrategia a medida que trabaja: cuanto más tiempo se ejecuta, mejores son los resultados....
Contexto total:
205K
Output máx.:
131K
Input:
$
1.19
/ M Tokens
Input almacenada en caché:
$
texto
/ M Tokens
Output:
$
3.74
/ M Tokens

Z.ai
Text Generation
GLM-5V-Turbo
GLM-5V-Turbo es el último modelo fundacional multimodal insignia de Zhipu, optimizado para codificación multimodal y capacidades de agentes. Admite un contexto de hasta 200K tokens de Image, Video y Text, y, cuando se integra con frameworks como Claude Code y OpenClaw, puede manejar tareas complejas de programación a largo plazo y de asistente....
Contexto total:
205K
Output máx.:
131K
Input:
$
1.2
/ M Tokens
Input almacenada en caché:
$
texto
/ M Tokens
Output:
$
4.0
/ M Tokens

Z.ai
Text Generation
GLM-5
GLM-5 es un modelo de código abierto de próxima generación para la ingeniería de sistemas complejos y tareas de agentes de largo horizonte, escalado a unos ~744B de parámetros dispersos (~40B activos) con unos ~28.5T de tokens de preentrenamiento. Integra la Atención Dispersa de DeepSeek (DSA) para mantener la capacidad de contexto largo mientras reduce el coste de inferencia, y aprovecha la pila de RL asíncrona "slime" para ofrecer un rendimiento sólido en razonamiento, codificación y evaluaciones de agentes....
Contexto total:
205K
Output máx.:
131K
Input:
$
0.95
/ M Tokens
Input almacenada en caché:
$
texto
/ M Tokens
Output:
$
2.55
/ M Tokens

