DeepSeek-R1-0120

DeepSeek-R1-0120

關於DeepSeek-R1-0120

DeepSeek-R1是一個由強化學習(RL)驅動的推理模型,旨在解決重複性和可讀性問題。在RL之前,DeepSeek-R1採用了冷啟動數據以進一步優化其推理性能。它在數學、代碼和推理任務上的表現可媲美OpenAI-o1,並通過精心設計的訓練方法提升整體效果。

元數據

創建於

許可證

供應商

DeepSeek

HuggingFace

規格

狀態

Deprecated

架構

經過校準的

專家並行

總參數

671B

啟用的參數

推理

精度

FP8

上下文長度

66K

最大輸出長度

準備好 加速您的人工智能開發了嗎?

準備好 加速您的人工智能開發了嗎?

準備好 加速您的人工智能開發了嗎?