Qwen3-8B

Acerca de Qwen3-8B

Qwen3-8B es el último modelo de lenguaje grande de la serie Qwen con 8,2B de parámetros. Este modelo permite de manera única alternar sin interrupciones entre el modo de pensamiento (para un razonamiento lógico complejo, matemáticas y programación) y el modo sin pensamiento (para un diálogo eficiente y de uso general). Demuestra una capacidad de razonamiento significativamente mejorada, superando a los modelos instruct anteriores QwQ y Qwen2.5 en matemáticas, generación de código y razonamiento lógico de sentido común. El modelo destaca en la alineación con las preferencias humanas para la escritura creativa, el juego de rol y los diálogos de múltiples turnos. Además, es compatible con más de 100 idiomas y dialectos, contando con excelentes capacidades de traducción y de seguimiento de instrucciones multilíngües.

Serverless disponible

Ejecute consultas de forma inmediata y pague solo por el uso

Precio de Input

$

0.06

/ M Tokens

Precio de Output

$

0.06

/ M Tokens

Metadatos

Creado el

Licencia

APACHE-2.0

Proveedor

Qwen

HuggingFace

Especificación

Estado

Available

Arquitectura

Causal Decoder-only

Calibrado

No

Mezcla de expertos

Parámetros totales

8B

Parámetros activados

8B

Razonamiento

No

Precisión

FP8

Longitud del contexto

131K

Tokens máximos

131K

Funcionalidades admitidas

Serverless

Compatible

Serverless LoRA

No compatible

Ajuste fino

No compatible

Embeddings

No compatible

Rerankers

No compatible

Soporte para Input de Image

No compatible

JSON Mode

Compatible

Outputs estructuradas

No compatible

Herramientas

Compatible

Finalización de Fim

No compatible

Completado de prefijo de Chat

No compatible

¿Listo para acelerar tu desarrollo de IA?

¿Listo para acelerar tu desarrollo de IA?

¿Listo para acelerar tu desarrollo de IA?

© 2026 SiliconFlow

© 2026 SiliconFlow

© 2026 SiliconFlow