Qwen3-Reranker-0.6B
Acerca de Qwen3-Reranker-0.6B
Qwen3-Reranker-0.6B es un modelo de reordenación de Text de la serie Qwen3. Está diseñado específicamente para refinar los resultados de los sistemas de recuperación iniciales al reordenar los documentos según su relevancia para una consulta determinada. Con 0.600 millones de parámetros y una longitud de contexto de 32k, este modelo aprovecha las sólidas capacidades de razonamiento, comprensión de textos largos y multilingüismo (compatible con más de 100 idiomas) de su base Qwen3. Los resultados de la evaluación muestran que Qwen3-Reranker-0.6B logra un alto rendimiento en varios puntos de referencia de recuperación de Text, incluidos MTEB-R, CMTEB-R y MLDR
Serverless disponible
Ejecute consultas de forma inmediata y pague solo por el uso
Precio de Input
$
0.01
/ M Tokens
Metadatos
Especificación
Estado
Available
Arquitectura
Dense Transformer
Calibrado
No
Mezcla de expertos
No
Parámetros totales
1B
Parámetros activados
0.6B
Razonamiento
No
Precisión
FP8
Longitud del contexto
33K
Tokens máximos
Funcionalidades admitidas
Serverless
Compatible
Serverless LoRA
No compatible
Ajuste fino
No compatible
Embeddings
No compatible
Rerankers
Compatible
Soporte para Input de Image
No compatible
JSON Mode
No compatible
Outputs estructuradas
No compatible
Herramientas
No compatible
Finalización de Fim
No compatible
Completado de prefijo de Chat
No compatible
Comparar con otros modelos
Descubre cómo se compara este modelo con otros.

Qwen
chat
Qwen3-VL-32B-Instruct
Contexto total:
262K
Output máx.:
262K
Input:
$
0.2
/ M Tokens
Output:
$
0.6
/ M Tokens

Qwen
chat
Qwen3-VL-32B-Thinking
Contexto total:
262K
Output máx.:
262K
Input:
$
0.2
/ M Tokens
Output:
$
1.5
/ M Tokens

Qwen
chat
Qwen3-VL-8B-Instruct
Contexto total:
262K
Output máx.:
262K
Input:
$
0.18
/ M Tokens
Output:
$
0.68
/ M Tokens

Qwen
chat
Qwen3-VL-8B-Thinking
Contexto total:
262K
Output máx.:
262K
Input:
$
0.18
/ M Tokens
Output:
$
2.0
/ M Tokens

Qwen
chat
Qwen3-VL-235B-A22B-Instruct
Contexto total:
262K
Output máx.:
262K
Input:
$
0.3
/ M Tokens
Output:
$
1.5
/ M Tokens

Qwen
chat
Qwen3-VL-235B-A22B-Thinking
Contexto total:
262K
Output máx.:
262K
Input:
$
0.45
/ M Tokens
Output:
$
3.5
/ M Tokens

Qwen
chat
Qwen3-VL-30B-A3B-Instruct
Contexto total:
262K
Output máx.:
262K
Input:
$
0.29
/ M Tokens
Output:
$
1.0
/ M Tokens

Qwen
chat
Qwen3-VL-30B-A3B-Thinking
Contexto total:
262K
Output máx.:
262K
Input:
$
0.29
/ M Tokens
Output:
$
1.0
/ M Tokens

Qwen
image-to-video
Wan2.2-I2V-A14B
$
0.29
/ Video
