Última generación

Biblioteca de modelos de IA

Una sola API para ejecutar inferencias en más de 200 modelos de IA de vanguardia y desplegarlos en segundos

Última generación

Biblioteca de modelos de IA

Una sola API para ejecutar inferencias en más de 200 modelos de IA de vanguardia y desplegarlos en segundos

Última generación

Biblioteca de modelos de IA

Una sola API para ejecutar inferencias en más de 200 modelos de IA de vanguardia y desplegarlos en segundos

Z.ai

Text Generation

GLM-4.7

GLM-4.7 es el modelo insignia de nueva generación de Zhipu, con un total de 355B de parámetros y 32B de parámetros activos, lo que ofrece mejoras integrales en conversación general, razonamiento y capacidades de agentes. Las respuestas son más concisas y naturales; la redacción se siente más inmersiva; las instrucciones de llamada a herramientas se siguen de manera más fiable; y se ha mejorado aún más el pulido de artefactos en el front-end y la programación con agentes, junto con la eficiencia en la ejecución de tareas de largo alcance....

Contexto total:

205K

Output máx.:

205K

Input:

$

0.42

/ M Tokens

Input almacenada en caché:

$

texto

/ M Tokens

Output:

$

2.2

/ M Tokens

Z.ai

Text Generation

GLM-4.5-Air

Los modelos de la serie GLM-4.5 son modelos fundacionales diseñados para agentes inteligentes. GLM-4.5-Air adopta un diseño más compacto con un total de 106.000 millones de parámetros y 12.000 millones de parámetros activos. También es un modelo de razonamiento híbrido que ofrece tanto el modo de pensamiento como el de no pensamiento....

Contexto total:

131K

Output máx.:

131K

Input:

$

0.14

/ M Tokens

Input almacenada en caché:

$

texto

/ M Tokens

Output:

$

0.86

/ M Tokens

Z.ai

Text Generation

GLM-5.2

GLM-5.2 es el modelo de código abierto más capaz de Z.ai hasta la fecha, diseñado para la ingeniería de agentes de largo alcance con una ventana de contexto de 1M de tokens que es verdaderamente utilizable. Mantiene intacto el estado del proyecto en tareas extremadamente largas, reduciendo la necesidad de comprimir o descartar el contexto: cuanto más larga es la tarea, más puede recordar y razonar....

Contexto total:

1049K

Output máx.:

262K

Input:

$

1.302

/ M Tokens

Input almacenada en caché:

$

texto

/ M Tokens

Output:

$

4.092

/ M Tokens

Z.ai

Text Generation

GLM-5.1

GLM-5.1 es el modelo insignia de próxima generación de Z.ai, creado para la ingeniería de agentes. Está diseñado para ejecutarse de forma continua durante horas o incluso más tiempo, perfeccionando su estrategia a medida que trabaja: cuanto más tiempo se ejecuta, mejores son los resultados....

Contexto total:

205K

Output máx.:

131K

Input:

$

1.19

/ M Tokens

Input almacenada en caché:

$

texto

/ M Tokens

Output:

$

3.74

/ M Tokens

Z.ai

Text Generation

GLM-5V-Turbo

GLM-5V-Turbo es el último modelo fundacional multimodal insignia de Zhipu, optimizado para codificación multimodal y capacidades de agentes. Admite un contexto de hasta 200K tokens de Image, Video y Text, y, cuando se integra con frameworks como Claude Code y OpenClaw, puede manejar tareas complejas de programación a largo plazo y de asistente....

Contexto total:

205K

Output máx.:

131K

Input:

$

1.2

/ M Tokens

Input almacenada en caché:

$

texto

/ M Tokens

Output:

$

4.0

/ M Tokens

Z.ai

Text Generation

GLM-5

GLM-5 es un modelo de código abierto de próxima generación para la ingeniería de sistemas complejos y tareas de agentes de largo horizonte, escalado a unos ~744B de parámetros dispersos (~40B activos) con unos ~28.5T de tokens de preentrenamiento. Integra la Atención Dispersa de DeepSeek (DSA) para mantener la capacidad de contexto largo mientras reduce el coste de inferencia, y aprovecha la pila de RL asíncrona "slime" para ofrecer un rendimiento sólido en razonamiento, codificación y evaluaciones de agentes....

Contexto total:

205K

Output máx.:

131K

Input:

$

0.95

/ M Tokens

Input almacenada en caché:

$

texto

/ M Tokens

Output:

$

2.55

/ M Tokens

¿Listo para acelerar tu desarrollo de IA?

¿Listo para acelerar tu desarrollo de IA?

¿Listo para acelerar tu desarrollo de IA?

© 2026 SiliconFlow

© 2026 SiliconFlow

© 2026 SiliconFlow