DeepSeek-V4-Flash

DeepSeek-V4-Flash

deepseek-ai/DeepSeek-V4-Flash

Acerca de DeepSeek-V4-Flash

DeepSeek-V4-Flash es el último modelo MoE de código abierto de DeepSeek, que cuenta con un total de 284B de parámetros, de los cuales solo 13B se activan durante la inferencia, lo que ofrece una generación de alta velocidad sin sacrificar la capacidad. Con soporte nativo para una ventana de contexto de 1M de tokens y tres modos de razonamiento intercambiables (Non-Think, Think High y Think Max), ofrece una escala de inteligencia flexible que va desde las tareas cotidianas hasta el razonamiento complejo, todo bajo la licencia MIT.

Serverless disponible

Ejecute consultas de forma inmediata y pague solo por el uso

Precio de Input

$

0.13

/ M Tokens

Lectura de caché

$

0.028

/ M Tokens

Precio de Output

$

0.28

/ M Tokens

Metadatos

Creado el

Licencia

MIT

Proveedor

DeepSeek

Especificación

Estado

Available

Arquitectura

MoE

Calibrado

Mezcla de expertos

Parámetros totales

158B

Parámetros activados

13B

Razonamiento

No

Precisión

FP8

Longitud del contexto

1049K

Tokens máximos

393K

Funcionalidades admitidas

Serverless

Compatible

Serverless LoRA

No compatible

Ajuste fino

No compatible

Embeddings

No compatible

Rerankers

No compatible

Soporte para Input de Image

No compatible

JSON Mode

Compatible

Outputs estructuradas

No compatible

Herramientas

Compatible

Finalización de Fim

No compatible

Completado de prefijo de Chat

Compatible

¿Listo para acelerar tu desarrollo de IA?

¿Listo para acelerar tu desarrollo de IA?

¿Listo para acelerar tu desarrollo de IA?

© 2026 SiliconFlow

© 2026 SiliconFlow

© 2026 SiliconFlow