DeepSeek-R1-Distill-Qwen-32B
Acerca de DeepSeek-R1-Distill-Qwen-32B
DeepSeek-R1-Distill-Qwen-32B es un modelo destilado basado en Qwen2.5-32B. El modelo se ajustó detalladamente utilizando 800.000 muestras seleccionadas y generadas por DeepSeek-R1, y demuestra un rendimiento excepcional en tareas de matemáticas, programación y razonamiento. Obtuvo resultados impresionantes en varios puntos de referencia, incluidos AIME 2024, MATH-500 y GPQA Diamond, con una notable precisión del 94,3% en MATH-500, lo que demuestra sus sólidas capacidades de razonamiento matemático.
Explore cómo las excepcionales capacidades de razonamiento, matemáticas y programación de DeepSeek-R1-Distill-Qwen-32B pueden resolver problemas complejos del mundo real.
Resolución avanzada de problemas científicos
Aproveche las superiores capacidades matemáticas y de razonamiento de DeepSeek-R1-Distill-Qwen-32B para abordar desafíos científicos complejos, desde la física teórica hasta el modelado bioquímico.
Ejemplo de caso de uso:
"Ayudó a un equipo de computación cuántica al derivar nuevos algoritmos para la corrección de errores, acelerando significativamente su cronograma de investigación."
Análisis y refinamiento de código multilenguaje
Vaya más allá de la depuración básica. Analice grandes bases de código en varios lenguajes para detectar fallos lógicos sutiles, optimizar algoritmos y mejorar la seguridad del sistema.
Ejemplo de caso de uso:
"Identificó una condición de carrera crítica en una aplicación blockchain basada en Rust mediante el rastreo de rutas de ejecución concurrentes, proporcionando una solución precisa y segura."
Estrategia financiera cuantitativa
Realice análisis cuantitativos profundos en vastos conjuntos de datos financieros, identifique patrones de mercado complejos y formule estrategias sólidas de inversión o trading algorítmico.
Ejemplo de caso de uso:
"Desarrolló un algoritmo de trading de alta frecuencia mediante el análisis de datos históricos del mercado e indicadores económicos, superando a los modelos tradicionales en un 15%."
Auditorías de cumplimiento y sistemas inteligentes
Automatice la auditoría de sistemas complejos, desde documentos regulatorios hasta diseños de ingeniería intrincados, garantizando el cumplimiento e identificando vulnerabilidades críticas.
Ejemplo de caso de uso:
"Auditó la configuración de una infraestructura en la nube a gran escala para verificar el cumplimiento de GDPR y SOC 2, señalando varias configuraciones incorrectas y sugiriendo pasos de mitigación."
Metadatos
Especificación
Estado
Deprecated
Arquitectura
Dense Transformer
Calibrado
No
Mezcla de expertos
No
Parámetros totales
32B
Parámetros activados
32B
Razonamiento
No
Precisión
FP8
Longitud del contexto
131K
Tokens máximos
131K
Comparar con otros modelos
Descubre cómo se compara este modelo con otros.
DeepSeek
chat
DeepSeek-V3.2
Contexto total:
164K
Output máx.:
164K
Input:
$
0.27
/ M Tokens
Output:
$
0.42
/ M Tokens
DeepSeek
chat
DeepSeek-V3.2-Exp
Contexto total:
164K
Output máx.:
164K
Input:
$
0.27
/ M Tokens
Output:
$
0.41
/ M Tokens
DeepSeek
chat
DeepSeek-V3.1-Terminus
Contexto total:
164K
Output máx.:
164K
Input:
$
0.27
/ M Tokens
Output:
$
1.0
/ M Tokens
DeepSeek
chat
DeepSeek-V3.1
Contexto total:
164K
Output máx.:
164K
Input:
$
0.27
/ M Tokens
Output:
$
1.0
/ M Tokens
DeepSeek
chat
DeepSeek-V3
Contexto total:
164K
Output máx.:
164K
Input:
$
0.25
/ M Tokens
Output:
$
1.0
/ M Tokens
DeepSeek
chat
DeepSeek-R1
Contexto total:
164K
Output máx.:
164K
Input:
$
0.5
/ M Tokens
Output:
$
2.18
/ M Tokens
DeepSeek
chat
DeepSeek-R1-Distill-Qwen-32B
Contexto total:
131K
Output máx.:
131K
Input:
$
0.18
/ M Tokens
Output:
$
0.18
/ M Tokens
DeepSeek
chat
DeepSeek-R1-Distill-Qwen-14B
Contexto total:
131K
Output máx.:
131K
Input:
$
0.1
/ M Tokens
Output:
$
0.1
/ M Tokens
DeepSeek
chat
DeepSeek-R1-Distill-Qwen-7B
Contexto total:
33K
Output máx.:
16K
Input:
$
0.05
/ M Tokens
Output:
$
0.05
/ M Tokens
