DeepSeek-R1-0120

DeepSeek-R1-0120

关于DeepSeek-R1-0120

DeepSeek-R1 是一个利用强化学习(RL)驱动的推理模型,解决了重复性和可读性问题。在引入 RL 之前,DeepSeek-R1 利用了冷启动数据来进一步优化其推理性能。它在数学、代码和推理任务上实现了与 OpenAI-o1 相当的性能,并通过精心设计的训练方法,提升了整体效能。

元数据

创建

许可证

提供者

DeepSeek

HuggingFace

规格

Deprecated

建筑

校准的

专家混合

总参数

671B

激活的参数

推理

精度

FP8

上下文长度

66K

最大输出长度

准备好 加速您的人工智能开发吗?

准备好 加速您的人工智能开发吗?

准备好 加速您的人工智能开发吗?