Qwen3-30B-A3B-Instruct-2507
Acerca de Qwen3-30B-A3B-Instruct-2507
Qwen3-30B-A3B-Instruct-2507 es la versión actualizada del modo sin pensamiento de Qwen3-30B-A3B. Es un modelo de Mezcla de Expertos (MoE) con 30,5 mil millones de parámetros totales y 3,3 mil millones de parámetros activados. Esta versión presenta mejoras clave, que incluyen avances significativos en capacidades generales como el seguimiento de instrucciones, el razonamiento lógico, la comprensión de Text, las matemáticas, la ciencia, la programación y el uso de herramientas. También muestra mejoras sustanciales en la cobertura de conocimientos de cola larga en múltiples idiomas y ofrece una alineación notablemente mejor con las preferencias del usuario en tareas subjetivas y abiertas, lo que permite respuestas de mayor utilidad y una generación de Text de mayor calidad. Además, sus capacidades en la comprensión de contextos largos se han mejorado hasta 256K. Este modelo solo admite el modo sin pensamiento y no genera bloques `<think></think>` en su Output
Serverless disponible
Ejecute consultas de forma inmediata y pague solo por el uso
Precio de Input
$
0.09
/ M Tokens
Precio de Output
$
0.3
/ M Tokens
Metadatos
Especificación
Estado
Available
Arquitectura
Mixture of Experts
Calibrado
No
Mezcla de expertos
Sí
Parámetros totales
30B
Parámetros activados
3.3B
Razonamiento
No
Precisión
FP8
Longitud del contexto
262K
Tokens máximos
262K
Funcionalidades admitidas
Serverless
Compatible
Serverless LoRA
No compatible
Ajuste fino
No compatible
Embeddings
No compatible
Rerankers
No compatible
Soporte para Input de Image
No compatible
JSON Mode
Compatible
Outputs estructuradas
No compatible
Herramientas
Compatible
Finalización de Fim
No compatible
Completado de prefijo de Chat
No compatible
Comparar con otros modelos
Descubre cómo se compara este modelo con otros.

Qwen
chat
Qwen3-VL-32B-Instruct
Contexto total:
262K
Output máx.:
262K
Input:
$
0.2
/ M Tokens
Output:
$
0.6
/ M Tokens

Qwen
chat
Qwen3-VL-32B-Thinking
Contexto total:
262K
Output máx.:
262K
Input:
$
0.2
/ M Tokens
Output:
$
1.5
/ M Tokens

Qwen
chat
Qwen3-VL-8B-Instruct
Contexto total:
262K
Output máx.:
262K
Input:
$
0.18
/ M Tokens
Output:
$
0.68
/ M Tokens

Qwen
chat
Qwen3-VL-8B-Thinking
Contexto total:
262K
Output máx.:
262K
Input:
$
0.18
/ M Tokens
Output:
$
2.0
/ M Tokens

Qwen
chat
Qwen3-VL-235B-A22B-Instruct
Contexto total:
262K
Output máx.:
262K
Input:
$
0.3
/ M Tokens
Output:
$
1.5
/ M Tokens

Qwen
chat
Qwen3-VL-235B-A22B-Thinking
Contexto total:
262K
Output máx.:
262K
Input:
$
0.45
/ M Tokens
Output:
$
3.5
/ M Tokens

Qwen
chat
Qwen3-VL-30B-A3B-Instruct
Contexto total:
262K
Output máx.:
262K
Input:
$
0.29
/ M Tokens
Output:
$
1.0
/ M Tokens

Qwen
chat
Qwen3-VL-30B-A3B-Thinking
Contexto total:
262K
Output máx.:
262K
Input:
$
0.29
/ M Tokens
Output:
$
1.0
/ M Tokens

Qwen
image-to-video
Wan2.2-I2V-A14B
$
0.29
/ Video
