DeepSeek-V4.1-Flash

DeepSeek-V4.1-Flash

deepseek-ai/DeepSeek-V4.1-Flash

О DeepSeek-V4.1-Flash

DeepSeek-V4.1-Flash is DeepSeek's latest multimodal MoE model with 552B backbone parameters. Built on a Causal Encoder-Decoder architecture, it activates only ~8B parameters during prefill and ~16B during decode, delivering flagship-level intelligence at significantly lower inference cost. The model natively understands images, supports a 1M-token context window. It outperforms DeepSeek-V4-Pro across coding, agentic and automation benchmarks, while reducing the KV cache footprint by roughly 4x versus its predecessor.

Доступный Serverless

Запускайте запросы немедленно, платите только за использование

За 1 миллион Tokens (Input/Output)

$

0.15

/ M Tokens

За 1 миллион Tokens (Input/Output)

$

0.003

/ M Tokens

За 1 миллион Tokens (Input/Output)

$

0.6

/ M Tokens

Метаданные

Создать на

Лицензия

MIT

Поставщик

DeepSeek

Спецификация

Государство

Available

Архитектура

Causal Encoder-Decoder MoE

Калибровка

Нет

Смешение экспертов

Да

Общее количество параметров

552B

Активированные параметры

8B / 16B

Мышление

Нет

Точность

ФП8

Контекст length

1049K

Максимум Tokens

393K

поддерживается функциональность

Безсерверный

поддерживается

Безсерверный LoRA

Не поддерживается

Тонкая настройка

Не поддерживается

Embeddings

Не поддерживается

Rerankers

Не поддерживается

Поддержка Image Input

поддерживается

Режим JSON

поддерживается

Структурированные Outputs

Не поддерживается

Инструменты

поддерживается

Завершение погашения

Не поддерживается

Chat Префикс Заполнение

поддерживается

Сравнить с другими Model

Посмотрите, как эта Model сравнивается с другими.

DeepSeek

chat

DeepSeek-V3.2

Общий Контекст:

164K

Максимальный Output:

164K

Input:

$

0.27

/ M Tokens

Output:

$

0.42

/ M Tokens

DeepSeek

chat

DeepSeek-V3.2-Exp

Общий Контекст:

164K

Максимальный Output:

164K

Input:

$

0.27

/ M Tokens

Output:

$

0.41

/ M Tokens

DeepSeek

chat

DeepSeek-V3.1-Terminus

Общий Контекст:

164K

Максимальный Output:

164K

Input:

$

0.27

/ M Tokens

Output:

$

1.0

/ M Tokens

DeepSeek

chat

DeepSeek-V3.1

Общий Контекст:

164K

Максимальный Output:

164K

Input:

$

0.27

/ M Tokens

Output:

$

1.0

/ M Tokens

DeepSeek

chat

DeepSeek-V3

Общий Контекст:

164K

Максимальный Output:

164K

Input:

$

0.25

/ M Tokens

Output:

$

1.0

/ M Tokens

DeepSeek

chat

DeepSeek-R1

Общий Контекст:

164K

Максимальный Output:

164K

Input:

$

0.5

/ M Tokens

Output:

$

2.18

/ M Tokens

DeepSeek

chat

DeepSeek-R1-Distill-Qwen-32B

Общий Контекст:

131K

Максимальный Output:

131K

Input:

$

0.18

/ M Tokens

Output:

$

0.18

/ M Tokens

DeepSeek

chat

DeepSeek-R1-Distill-Qwen-14B

Общий Контекст:

131K

Максимальный Output:

131K

Input:

$

0.1

/ M Tokens

Output:

$

0.1

/ M Tokens

DeepSeek

chat

DeepSeek-R1-Distill-Qwen-7B

Общий Контекст:

33K

Максимальный Output:

16K

Input:

$

0.05

/ M Tokens

Output:

$

0.05

/ M Tokens

Готовы ускорить ваше развитие ИИ?

Готовы ускорить ваше развитие ИИ?

Готовы ускорить ваше развитие ИИ?