Precios de Serverless

Precios de tokens flexibles, límites de uso elevados y facturación a posteriori, ¡además de $1 en créditos gratuitos para empezar!

DeepSeek

DeepSeek lanzó el primer modelo de pesos abiertos y ha captado la atención mundial por crear LLMs altamente capaces y rentables. Modelos como DeepSeek-V3.2 y DeepSeek-R1 son competitivos con los mejores modelos internacionales, ofreciendo un rendimiento extraordinario en razonamiento, programación y resolución de problemas matemáticos.

DeepSeek lanzó el primer modelo de pesos abiertos y ha captado la atención mundial por crear LLMs altamente capaces y rentables. Modelos como DeepSeek-V3.2 y DeepSeek-R1 son competitivos con los mejores modelos internacionales, ofreciendo un rendimiento extraordinario en razonamiento, programación y resolución de problemas matemáticos.

Nombre del modelo

Longitud de contexto

Longitud de contexto

Input

Input almacenada en caché

Output

Acciones

DeepSeek-V4-Pro

1049K

$

1.50162

$

0.135

$

3.135

Nombre del modelo

DeepSeek-V4-Pro

1049K

Longitud de contexto

Input (/M tokens)

$

1.50162

Input almacenado en caché (/M tokens)

$

0.135

$

3.135

Output (/M tokens)

DeepSeek-V4-Pro

1049K

$

1.50162

$

0.135

$

3.135

DeepSeek-V4-Flash

1049K

$

0.13

$

0.028

$

0.28

Nombre del modelo

DeepSeek-V4-Flash

1049K

Longitud de contexto

Input (/M tokens)

$

0.13

Input almacenado en caché (/M tokens)

$

0.028

$

0.28

Output (/M tokens)

DeepSeek-V4-Flash

1049K

$

0.13

$

0.028

$

0.28

DeepSeek-V3.2

164K

$

0.27

$

0.135

$

0.42

Nombre del modelo

DeepSeek-V3.2

164K

Longitud de contexto

Input (/M tokens)

$

0.27

Input almacenado en caché (/M tokens)

$

0.135

$

0.42

Output (/M tokens)

DeepSeek-V3.2

164K

$

0.27

$

0.135

$

0.42

DeepSeek-V3.2-Exp

164K

$

0.27

$

0.41

Nombre del modelo

DeepSeek-V3.2-Exp

164K

Longitud de contexto

Input (/M tokens)

$

0.27

$

0.41

Output (/M tokens)

DeepSeek-V3.2-Exp

164K

$

0.27

$

0.41

DeepSeek-V3.1-Terminus

164K

$

0.27

$

1.0

Nombre del modelo

DeepSeek-V3.1-Terminus

164K

Longitud de contexto

Input (/M tokens)

$

0.27

$

1.0

Output (/M tokens)

DeepSeek-V3.1-Terminus

164K

$

0.27

$

1.0

Los precios mostrados son por cada millón de tokens.

Qwen

Familia de modelos de IA de código abierto creada por Alibaba Cloud, que abarca desde menos de 1B hasta más de 480B de parámetros, diseñada para adaptarse a cualquier caso de uso, desde el razonamiento profundo y las matemáticas hasta la codificación autónoma.

Familia de modelos de IA de código abierto creada por Alibaba Cloud, que abarca desde menos de 1B hasta más de 480B de parámetros, diseñada para adaptarse a cualquier caso de uso, desde el razonamiento profundo y las matemáticas hasta la codificación autónoma.

Nombre del modelo

Nombre del modelo

Longitud de contexto

Longitud de contexto

Input

Input almacenada en caché

Output

Acciones

Qwen3.6-27B

262K

$

0.3

$

3.2

Nombre del modelo

Qwen3.6-27B

262K

Longitud de contexto

Input (/M tokens)

$

0.3

$

3.2

Output (/M tokens)

Qwen3.6-27B

262K

$

0.3

$

3.2

Qwen3.6-35B-A3B

262K

$

0.2

$

1.6

Nombre del modelo

Qwen3.6-35B-A3B

262K

Longitud de contexto

Input (/M tokens)

$

0.2

$

1.6

Output (/M tokens)

Qwen3.6-35B-A3B

262K

$

0.2

$

1.6

Qwen3.5-9B

262K

$

0.1

$

0.15

Nombre del modelo

Qwen3.5-9B

262K

Longitud de contexto

Input (/M tokens)

$

0.1

$

0.15

Output (/M tokens)

Qwen3.5-9B

262K

$

0.1

$

0.15

Qwen3.5-122B-A10B

262K

$

0.26

$

2.08

Nombre del modelo

Qwen3.5-122B-A10B

262K

Longitud de contexto

Input (/M tokens)

$

0.26

$

2.08

Output (/M tokens)

Qwen3.5-122B-A10B

262K

$

0.26

$

2.08

Qwen3.5-27B

262K

$

0.25

$

2.0

Nombre del modelo

Qwen3.5-27B

262K

Longitud de contexto

Input (/M tokens)

$

0.25

$

2.0

Output (/M tokens)

Qwen3.5-27B

262K

$

0.25

$

2.0

Los precios mostrados son por cada millón de tokens.

Z.ai

Zhipu AI crea la familia ChatGLM de LLM y desarrolla LLM como agentes. El modelo más reciente, GLM-4.7, ofrece un rendimiento de vanguardia en tareas de programación, escritura creativa y escenarios de juego de rol.

Zhipu AI crea la familia ChatGLM de LLM y desarrolla LLM como agentes. El modelo más reciente, GLM-4.7, ofrece un rendimiento de vanguardia en tareas de programación, escritura creativa y escenarios de juego de rol.

Nombre del modelo

Nombre del modelo

Longitud de contexto

Longitud de contexto

Input

Input almacenada en caché

Output

Acciones

GLM-5.2

1049K

$

1.302

$

0.26

$

4.092

Nombre del modelo

GLM-5.2

1049K

Longitud de contexto

Input (/M tokens)

$

1.302

Input almacenado en caché (/M tokens)

$

0.26

$

4.092

Output (/M tokens)

GLM-5.2

1049K

$

1.302

$

0.26

$

4.092

GLM-5.1

205K

$

1.19

$

0.6

$

3.74

Nombre del modelo

GLM-5.1

205K

Longitud de contexto

Input (/M tokens)

$

1.19

Input almacenado en caché (/M tokens)

$

0.6

$

3.74

Output (/M tokens)

GLM-5.1

205K

$

1.19

$

0.6

$

3.74

GLM-5

205K

$

0.95

$

0.2

$

2.55

Nombre del modelo

GLM-5

205K

Longitud de contexto

Input (/M tokens)

$

0.95

Input almacenado en caché (/M tokens)

$

0.2

$

2.55

Output (/M tokens)

GLM-5

205K

$

0.95

$

0.2

$

2.55

GLM-4.5-Air

131K

$

0.14

$

0.86

Nombre del modelo

GLM-4.5-Air

131K

Longitud de contexto

Input (/M tokens)

$

0.14

$

0.86

Output (/M tokens)

GLM-4.5-Air

131K

$

0.14

$

0.86

GLM-5V-Turbo

205K

$

1.2

$

0.24

$

4.0

Nombre del modelo

GLM-5V-Turbo

205K

Longitud de contexto

Input (/M tokens)

$

1.2

Input almacenado en caché (/M tokens)

$

0.24

$

4.0

Output (/M tokens)

GLM-5V-Turbo

205K

$

1.2

$

0.24

$

4.0

Los precios mostrados son por cada millón de tokens.

Moonshot AI

Moonshot AI destaca por sus avances en modelos de lenguaje de contexto largo. Su producto estrella, Kimi, está especialmente diseñado para la investigación, el trabajo jurídico y la síntesis de información compleja. El último lanzamiento, Kimi K2 Thinking, es un agente de pensamiento de última generación con razonamiento profundo y orquestación de herramientas.

Moonshot AI destaca por sus avances en modelos de lenguaje de contexto largo. Su producto estrella, Kimi, está especialmente diseñado para la investigación, el trabajo jurídico y la síntesis de información compleja. El último lanzamiento, Kimi K2 Thinking, es un agente de pensamiento de última generación con razonamiento profundo y orquestación de herramientas.

Nombre del modelo

Nombre del modelo

Longitud de contexto

Longitud de contexto

Input

Input

Input almacenada en caché

Output

Output

Acciones

Acciones

Kimi-K3

1049K

$

3.0

$

0.3

$

15.0

Nombre del modelo

Kimi-K3

1049K

Longitud de contexto

Input (/M tokens)

$

3.0

Input almacenado en caché (/M tokens)

$

0.3

$

15.0

Output (/M tokens)

Kimi-K2.5

262K

$

0.45

$

0.07

$

2.25

Nombre del modelo

Kimi-K2.5

262K

Longitud de contexto

Input (/M tokens)

$

0.45

Input almacenado en caché (/M tokens)

$

0.07

$

2.25

Output (/M tokens)

Kimi-K2.6

262K

$

0.77

$

0.14

$

3.4

Nombre del modelo

Kimi-K2.6

262K

Longitud de contexto

Input (/M tokens)

$

0.77

Input almacenado en caché (/M tokens)

$

0.14

$

3.4

Output (/M tokens)

Kimi-K2.7-Code

262K

$

0.85916

$

0.17993

$

3.8

Nombre del modelo

Kimi-K2.7-Code

262K

Longitud de contexto

Input (/M tokens)

$

0.85916

Input almacenado en caché (/M tokens)

$

0.17993

$

3.8

Output (/M tokens)

Kimi-K2.7-Code

262K

$

0.85916

$

0.17993

$

3.8

Kimi-K2.6

262K

$

0.77

$

0.14

$

3.4

Kimi-K2.5

262K

$

0.45

$

0.07

$

2.25

Kimi-K3

1049K

$

3.0

$

0.3

$

15.0

Los precios mostrados son por cada millón de tokens.

MiniMaxAI

Especializada en capacidades multimodales, MiniMax desarrolla modelos avanzados que integran a la perfección texto, voz y visión, con logros notables en la conversión de texto a voz con sonido natural y la clonación de voz.

Especializada en capacidades multimodales, MiniMax desarrolla modelos avanzados que integran a la perfección texto, voz y visión, con logros notables en la conversión de texto a voz con sonido natural y la clonación de voz.

Nombre del modelo

Nombre del modelo

Longitud de contexto

Longitud de contexto

Input

Input

Input almacenada en caché

Output

Output

Acciones

Acciones

MiniMax-M2.5

197K

$

0.3

$

0.03

$

1.2

Nombre del modelo

MiniMax-M2.5

197K

Longitud de contexto

Input (/M tokens)

$

0.3

Input almacenado en caché (/M tokens)

$

0.03

$

1.2

Output (/M tokens)

MiniMax-M2.5

197K

$

0.3

$

0.03

$

1.2

MiniMax-M3

1049K

$

0.3

$

0.06

$

1.2

Nombre del modelo

MiniMax-M3

1049K

Longitud de contexto

Input (/M tokens)

$

0.3

Input almacenado en caché (/M tokens)

$

0.06

$

1.2

Output (/M tokens)

MiniMax-M3

1049K

$

0.3

$

0.06

$

1.2

Los precios mostrados son por cada millón de tokens.

OpenAI

OpenAI es una organización de investigación de IA pionera que ayudó a impulsar la revolución de la IA generativa actual. Su serie GPT llevó los LLM al público general y actualmente está liderada por GPT-5.2 y o3, que establecen puntos de referencia en la industria para la comprensión, generación y razonamiento del lenguaje natural.

OpenAI es una organización de investigación de IA pionera que ayudó a impulsar la revolución de la IA generativa actual. Su serie GPT llevó los LLM al público general y actualmente está liderada por GPT-5.2 y o3, que establecen puntos de referencia en la industria para la comprensión, generación y razonamiento del lenguaje natural.

Nombre del modelo

Nombre del modelo

Longitud de contexto

Longitud de contexto

Input

Input

Input almacenada en caché

Output

Output

Acciones

Acciones

gpt-oss-120b

131K

$

0.05

$

0.45

Nombre del modelo

gpt-oss-120b

131K

Longitud de contexto

Input (/M tokens)

$

0.05

$

0.45

Output (/M tokens)

gpt-oss-120b

131K

$

0.05

$

0.45

gpt-oss-20b

131K

$

0.04

$

0.18

Nombre del modelo

gpt-oss-20b

131K

Longitud de contexto

Input (/M tokens)

$

0.04

$

0.18

Output (/M tokens)

gpt-oss-20b

131K

$

0.04

$

0.18

Los precios mostrados son por cada millón de tokens.

Otros

Nombre del modelo

Nombre del modelo

Longitud de contexto

Longitud de contexto

Input

Input

Input almacenada en caché

Output

Output

Acciones

Acciones

gemma-4-12B-it

262K

$

0.1

$

0.3

Nombre del modelo

gemma-4-12B-it

262K

Longitud de contexto

Input (/M tokens)

$

0.1

$

0.3

Output (/M tokens)

gemma-4-12B-it

262K

$

0.1

$

0.3

gemma-4-26B-A4B-it

262K

$

0.12

$

0.4

Nombre del modelo

gemma-4-26B-A4B-it

262K

Longitud de contexto

Input (/M tokens)

$

0.12

$

0.4

Output (/M tokens)

gemma-4-26B-A4B-it

262K

$

0.12

$

0.4

gemma-4-31B-it

262K

$

0.13

$

0.4

Nombre del modelo

gemma-4-31B-it

262K

Longitud de contexto

Input (/M tokens)

$

0.13

$

0.4

Output (/M tokens)

gemma-4-31B-it

262K

$

0.13

$

0.4

Hunyuan-A13B-Instruct

131K

$

0.14

$

0.57

Nombre del modelo

Hunyuan-A13B-Instruct

131K

Longitud de contexto

Input (/M tokens)

$

0.14

$

0.57

Output (/M tokens)

Hunyuan-A13B-Instruct

131K

$

0.14

$

0.57

Hy3

262K

$

0.0

$

0.0

Nombre del modelo

Hy3

262K

Longitud de contexto

Input (/M tokens)

$

0.0

$

0.0

Output (/M tokens)

Hy3

262K

$

0.0

$

0.0

Los precios mostrados son por cada millón de tokens.

Generación de Image

Genera imágenes de alta calidad a partir de prompts de texto con nuestros modelos de generación de imágenes de última generación.

Nombre del modelo

Precio (/Image)

Acciones

FLUX 1.1 [pro]

$

0.04

Nombre del modelo

FLUX 1.1 [pro]

$

0.04

Precio (

)

/ Image

FLUX 1.1 [pro]

$

0.04

FLUX 1.1 [pro] Ultra

$

0.06

Nombre del modelo

FLUX 1.1 [pro] Ultra

$

0.06

Precio (

)

/ Image

FLUX 1.1 [pro] Ultra

$

0.06

FLUX.1 Kontext [max]

$

0.08

Nombre del modelo

FLUX.1 Kontext [max]

$

0.08

Precio (

)

/ Image

FLUX.1 Kontext [max]

$

0.08

FLUX.1 Kontext [pro]

$

0.04

Nombre del modelo

FLUX.1 Kontext [pro]

$

0.04

Precio (

)

/ Image

FLUX.1 Kontext [pro]

$

0.04

FLUX.1-dev

$

0.014

Nombre del modelo

FLUX.1-dev

$

0.014

Precio (

)

/ Image

FLUX.1-dev

$

0.014

Los precios mostrados son por Image generada o editada.

Generación de video

Cree videos dinámicos a partir de descripciones de texto con nuestros modelos de generación de video de última generación.

Nombre del modelo

Precio (/video)

Acciones

Wan2.2-I2V-A14B

$

0.29

Nombre del modelo

Wan2.2-I2V-A14B

$

0.29

Precio (

)

/ Video

Wan2.2-I2V-A14B

$

0.29

Wan2.2-T2V-A14B

$

0.29

Nombre del modelo

Wan2.2-T2V-A14B

$

0.29

Precio (

)

/ Video

Wan2.2-T2V-A14B

$

0.29

Los precios mostrados son por vídeo generado.

Modelos de Audio

Procesa y genera Audio con nuestros modelos de síntesis y reconocimiento de voz de alta calidad.

Nombre del modelo

Output (/M Bytes UTF-8)

Acciones

Fish-Speech-1.5

$

15.0

Nombre del modelo

Fish-Speech-1.5

$

15.0

Precio (

)

/ M UTF-8 bytes

Fish-Speech-1.5

$

15.0

FunAudioLLM/CosyVoice2-0.5B

$

7.15

Nombre del modelo

FunAudioLLM/CosyVoice2-0.5B

$

7.15

Precio (

)

/ M UTF-8 bytes

FunAudioLLM/CosyVoice2-0.5B

$

7.15

IndexTTS-2

$

7.15

Nombre del modelo

IndexTTS-2

$

7.15

Precio (

)

/ M UTF-8 bytes

IndexTTS-2

$

7.15

Los precios de la transcripción y la traducción son por minuto de Audio. Los precios de Text-to-Speech son por cada 1.000 caracteres.

Preguntas frecuentes

¿Cómo funciona la facturación?

Se te factura en función de tu uso. Para los modelos de chat, se te cobra por token tanto para el input como el output. Para los modelos de image, video y audio, el precio varía según la tarea específica y la calidad del output.

¿Hay algún compromiso mínimo?

No, no hay compromisos mínimos. Solo pagas por lo que usas y puedes empezar con $1 en créditos gratuitos.

¿Puedo establecer límites de gasto?

Sí, puede establecer límites de gasto mensuales en el panel de control de su cuenta para controlar los costes y evitar cargos inesperados.

¿Ofrecen descuentos por volumen?

Sí, ofrecemos descuentos por volumen para clientes de alto consumo. Si su volumen de uso es significativo, póngase en contacto con nuestro equipo de ventas, que podrá diseñar un plan de precios personalizado y adaptado a sus necesidades.

¿Cómo empiezo?

Regístrate para obtener una cuenta, consigue tu clave de API y empieza a usar nuestros modelos de inmediato. Ofrecemos documentación completa y ejemplos de código para ayudarte a realizar la integración rápidamente.

¿Listo para acelerar tu desarrollo de IA?

¿Listo para acelerar tu desarrollo de IA?

¿Listo para acelerar tu desarrollo de IA?

© 2026 SiliconFlow

© 2026 SiliconFlow

© 2026 SiliconFlow