DeepSeek-R1-Distill-Llama-70B

DeepSeek-R1-Distill-Llama-70B

Acerca de DeepSeek-R1-Distill-Llama-70B

DeepSeek-R1-Distill-Llama-70B es un modelo destilado basado en Llama-3.3-70B-Instruct. Como parte de la serie DeepSeek-R1, se perfeccionó utilizando muestras generadas por DeepSeek-R1 y demuestra un rendimiento excelente en tareas de matemáticas, programación y razonamiento. El modelo obtuvo resultados impresionantes en varios puntos de referencia, incluidos AIME 2024, MATH-500 y GPQA Diamond, lo que demuestra sus sólidas capacidades de razonamiento.

Metadatos

Creado el

Licencia

MIT

Proveedor

DeepSeek

Especificación

Estado

Deprecated

Arquitectura

Calibrado

No

Mezcla de expertos

No

Parámetros totales

70B

Parámetros activados

Razonamiento

No

Precisión

FP8

Longitud del contexto

33K

Tokens máximos

¿Listo para acelerar tu desarrollo de IA?

¿Listo para acelerar tu desarrollo de IA?

¿Listo para acelerar tu desarrollo de IA?

© 2026 SiliconFlow

© 2026 SiliconFlow

© 2026 SiliconFlow