
Comparación de modelos
DeepSeek-V3.1
contra
DeepSeek-V4-Flash
Precios
Input
$
0.27
/ M Tokens
$
0.13
/ M Tokens
Output
$
1.0
/ M Tokens
$
0.28
/ M Tokens
Metadatos
Especificación
Estado
Available
Available
Arquitectura
MoE Transformer
MoE
Calibrado
Sí
Sí
Mezcla de expertos
Sí
Sí
Parámetros totales
671B
158B
Parámetros activados
37B
13B
Razonamiento
No
No
Precisión
FP8
FP8
Longitud del contexto
164K
1049K
Tokens máximos
164K
393K
Funcionalidades admitidas
Serverless
Compatible
Compatible
Serverless LoRA
No compatible
No compatible
Ajuste fino
No compatible
No compatible
Embeddings
No compatible
No compatible
Rerankers
No compatible
No compatible
Soporte para Input de Image
No compatible
No compatible
JSON Mode
Compatible
Compatible
Outputs estructuradas
No compatible
No compatible
Herramientas
Compatible
Compatible
Finalización de Fim
Compatible
No compatible
Completado de prefijo de Chat
Compatible
Compatible
DeepSeek-V3.1 en comparación
Ver cómo DeepSeek-V3.1 se compara con otros modelos populares en dimensiones clave.
vs.
DeepSeek-V4-Flash
vs.
DeepSeek-V4-Pro
vs.

GLM-5.1
vs.

Qwen3.5-122B-A10B
vs.

Qwen3.5-397B-A17B
vs.

MiniMax-M2.5
vs.

GLM-5
vs.

Step-3.5-Flash
vs.

GLM-4.7
vs.

MiniMax-M2.1
vs.

GLM-4.6V
vs.
DeepSeek-V3.2
vs.

DeepSeek-V3.1-Nex-N1
vs.

Kimi-K2-Thinking
vs.

MiniMax-M2
vs.
DeepSeek-V3.2-Exp
vs.

GLM-4.6
vs.
DeepSeek-V3.1-Terminus
vs.

Qwen3-VL-235B-A22B-Instruct
vs.

Qwen3-VL-235B-A22B-Thinking
