Qwen3.5-122B-A10B
Acerca de Qwen3.5-122B-A10B
Qwen3.5-122B-A10B es un modelo de lenguaje grande Multimodal nativo del equipo Qwen, con 122B de parámetros totales y solo 10B activos. Cuenta con una arquitectura híbrida eficiente que combina Gated Delta Networks con Mixture-of-Experts (MoE) disperso, admitiendo de forma nativa una longitud de contexto de 256K ampliable hasta ~1M tokens. A través de un entrenamiento de fusión temprana, logra capacidades unificadas de lenguaje visual que admiten la comprensión de Text, Image y Video, con un sólido rendimiento en conocimiento, razonamiento, codificación, agentes, comprensión visual y evaluaciones comparativas multilingües, superando a GPT-5-mini y Qwen3-235B-A22B en múltiples métricas. Se activa de manera predeterminada en modo de pensamiento, admite llamadas a herramientas y cubre 201 idiomas y dialectos.
Serverless disponible
Ejecute consultas de forma inmediata y pague solo por el uso
Precio de Input
$
0.26
/ M Tokens
Precio de Output
$
2.08
/ M Tokens
Metadatos
Especificación
Estado
Available
Arquitectura
Hybrid Sparse MoE
Calibrado
Sí
Mezcla de expertos
Sí
Parámetros totales
122B
Parámetros activados
10B
Razonamiento
No
Precisión
FP8
Longitud del contexto
262K
Tokens máximos
262K
Funcionalidades admitidas
Serverless
Compatible
Serverless LoRA
No compatible
Ajuste fino
No compatible
Embeddings
No compatible
Rerankers
No compatible
Soporte para Input de Image
Compatible
JSON Mode
Compatible
Outputs estructuradas
No compatible
Herramientas
Compatible
Finalización de Fim
No compatible
Completado de prefijo de Chat
No compatible
Comparar con otros modelos
Descubre cómo se compara este modelo con otros.

Qwen
chat
Qwen3-VL-32B-Instruct
Contexto total:
262K
Output máx.:
262K
Input:
$
0.2
/ M Tokens
Output:
$
0.6
/ M Tokens

Qwen
chat
Qwen3-VL-32B-Thinking
Contexto total:
262K
Output máx.:
262K
Input:
$
0.2
/ M Tokens
Output:
$
1.5
/ M Tokens

Qwen
chat
Qwen3-VL-8B-Instruct
Contexto total:
262K
Output máx.:
262K
Input:
$
0.18
/ M Tokens
Output:
$
0.68
/ M Tokens

Qwen
chat
Qwen3-VL-8B-Thinking
Contexto total:
262K
Output máx.:
262K
Input:
$
0.18
/ M Tokens
Output:
$
2.0
/ M Tokens

Qwen
chat
Qwen3-VL-235B-A22B-Instruct
Contexto total:
262K
Output máx.:
262K
Input:
$
0.3
/ M Tokens
Output:
$
1.5
/ M Tokens

Qwen
chat
Qwen3-VL-235B-A22B-Thinking
Contexto total:
262K
Output máx.:
262K
Input:
$
0.45
/ M Tokens
Output:
$
3.5
/ M Tokens

Qwen
chat
Qwen3-VL-30B-A3B-Instruct
Contexto total:
262K
Output máx.:
262K
Input:
$
0.29
/ M Tokens
Output:
$
1.0
/ M Tokens

Qwen
chat
Qwen3-VL-30B-A3B-Thinking
Contexto total:
262K
Output máx.:
262K
Input:
$
0.29
/ M Tokens
Output:
$
1.0
/ M Tokens

Qwen
image-to-video
Wan2.2-I2V-A14B
$
0.29
/ Video
