DeepSeek-R1-0120

DeepSeek-R1-0120

Acerca de DeepSeek-R1-0120

DeepSeek-R1 es un modelo de razonamiento impulsado por aprendizaje por refuerzo (RL) que aborda los problemas de repetición y legibilidad. Antes del RL, DeepSeek-R1 incorporó datos de arranque en frío (cold-start) para optimizar aún más su rendimiento de razonamiento. Logra un rendimiento comparable al de OpenAI-o1 en tareas de matemáticas, código y razonamiento, y, a través de métodos de entrenamiento cuidadosamente diseñados, ha mejorado su efectividad general.

Metadatos

Creado el

Licencia

Proveedor

DeepSeek

HuggingFace

Especificación

Estado

Deprecated

Arquitectura

Calibrado

No

Mezcla de expertos

No

Parámetros totales

671B

Parámetros activados

Razonamiento

No

Precisión

FP8

Longitud del contexto

66K

Tokens máximos

¿Listo para acelerar tu desarrollo de IA?

¿Listo para acelerar tu desarrollo de IA?

¿Listo para acelerar tu desarrollo de IA?

© 2026 SiliconFlow

© 2026 SiliconFlow

© 2026 SiliconFlow