DeepSeek-V4.1-Flash

DeepSeek-V4.1-Flash

deepseek-ai/DeepSeek-V4.1-Flash

Acerca de DeepSeek-V4.1-Flash

DeepSeek-V4.1-Flash es el último modelo MoE Multimodal de DeepSeek con 552B de parámetros en su estructura base. Construido sobre una arquitectura Causal Encoder-Decoder, activa solo unos ~8B de parámetros durante el prefill y ~16B durante el decode, ofreciendo una inteligencia de nivel de buque insignia a un coste de inferencia significativamente menor. El modelo comprende nativamente Images y admite una ventana de contexto de 1M de tokens. Supera a DeepSeek-V4-Pro en pruebas de rendimiento de programación, tareas de agentes y automatización, al tiempo que reduce la huella de caché KV en aproximadamente 4 veces en comparación con su predecesor.

Serverless disponible

Ejecute consultas de forma inmediata y pague solo por el uso

Precio de Input

$

0.15

/ M Tokens

Lectura de caché

$

0.003

/ M Tokens

Precio de Output

$

0.6

/ M Tokens

Metadatos

Creado el

Licencia

MIT

Proveedor

DeepSeek

Especificación

Estado

Available

Arquitectura

Causal Encoder-Decoder MoE

Calibrado

No

Mezcla de expertos

Parámetros totales

552B

Parámetros activados

8B / 16B

Razonamiento

No

Precisión

FP8

Longitud del contexto

1049K

Tokens máximos

393K

Funcionalidades admitidas

Serverless

Compatible

Serverless LoRA

No compatible

Ajuste fino

No compatible

Embeddings

No compatible

Rerankers

No compatible

Soporte para Input de Image

Compatible

JSON Mode

Compatible

Outputs estructuradas

No compatible

Herramientas

Compatible

Finalización de Fim

No compatible

Completado de prefijo de Chat

Compatible

¿Listo para acelerar tu desarrollo de IA?

¿Listo para acelerar tu desarrollo de IA?

¿Listo para acelerar tu desarrollo de IA?

© 2026 SiliconFlow

© 2026 SiliconFlow

© 2026 SiliconFlow