DeepSeek-V4.1-Flash
Acerca de DeepSeek-V4.1-Flash
DeepSeek-V4.1-Flash es el último modelo MoE Multimodal de DeepSeek con 552B de parámetros en su estructura base. Construido sobre una arquitectura Causal Encoder-Decoder, activa solo unos ~8B de parámetros durante el prefill y ~16B durante el decode, ofreciendo una inteligencia de nivel de buque insignia a un coste de inferencia significativamente menor. El modelo comprende nativamente Images y admite una ventana de contexto de 1M de tokens. Supera a DeepSeek-V4-Pro en pruebas de rendimiento de programación, tareas de agentes y automatización, al tiempo que reduce la huella de caché KV en aproximadamente 4 veces en comparación con su predecesor.
Serverless disponible
Ejecute consultas de forma inmediata y pague solo por el uso
Precio de Input
$
0.15
/ M Tokens
Lectura de caché
$
0.003
/ M Tokens
Precio de Output
$
0.6
/ M Tokens
Metadatos
Especificación
Estado
Available
Arquitectura
Causal Encoder-Decoder MoE
Calibrado
No
Mezcla de expertos
Sí
Parámetros totales
552B
Parámetros activados
8B / 16B
Razonamiento
No
Precisión
FP8
Longitud del contexto
1049K
Tokens máximos
393K
Funcionalidades admitidas
Serverless
Compatible
Serverless LoRA
No compatible
Ajuste fino
No compatible
Embeddings
No compatible
Rerankers
No compatible
Soporte para Input de Image
Compatible
JSON Mode
Compatible
Outputs estructuradas
No compatible
Herramientas
Compatible
Finalización de Fim
No compatible
Completado de prefijo de Chat
Compatible
Comparar con otros modelos
Descubre cómo se compara este modelo con otros.
DeepSeek
chat
DeepSeek-V3.2
Contexto total:
164K
Output máx.:
164K
Input:
$
0.27
/ M Tokens
Output:
$
0.42
/ M Tokens
DeepSeek
chat
DeepSeek-V3.2-Exp
Contexto total:
164K
Output máx.:
164K
Input:
$
0.27
/ M Tokens
Output:
$
0.41
/ M Tokens
DeepSeek
chat
DeepSeek-V3.1-Terminus
Contexto total:
164K
Output máx.:
164K
Input:
$
0.27
/ M Tokens
Output:
$
1.0
/ M Tokens
DeepSeek
chat
DeepSeek-V3.1
Contexto total:
164K
Output máx.:
164K
Input:
$
0.27
/ M Tokens
Output:
$
1.0
/ M Tokens
DeepSeek
chat
DeepSeek-V3
Contexto total:
164K
Output máx.:
164K
Input:
$
0.25
/ M Tokens
Output:
$
1.0
/ M Tokens
DeepSeek
chat
DeepSeek-R1
Contexto total:
164K
Output máx.:
164K
Input:
$
0.5
/ M Tokens
Output:
$
2.18
/ M Tokens
DeepSeek
chat
DeepSeek-R1-Distill-Qwen-32B
Contexto total:
131K
Output máx.:
131K
Input:
$
0.18
/ M Tokens
Output:
$
0.18
/ M Tokens
DeepSeek
chat
DeepSeek-R1-Distill-Qwen-14B
Contexto total:
131K
Output máx.:
131K
Input:
$
0.1
/ M Tokens
Output:
$
0.1
/ M Tokens
DeepSeek
chat
DeepSeek-R1-Distill-Qwen-7B
Contexto total:
33K
Output máx.:
16K
Input:
$
0.05
/ M Tokens
Output:
$
0.05
/ M Tokens
