Qwen3-Embedding-0.6B
Acerca de Qwen3-Embedding-0.6B
Qwen3-Embedding-0.6B es el último modelo propietario de la serie Qwen3 Embedding, diseñado específicamente para tareas de Embedding y clasificación de Text. Desarrollado a partir de los modelos fundacionales densos de la serie Qwen3, este modelo de 0.6B parámetros admite longitudes de contexto de hasta 32K y puede generar embeddings con dimensiones de hasta 1024. El modelo hereda unas capacidades multilingües excepcionales que admiten más de 100 idiomas, junto con habilidades de comprensión y razonamiento de Text largo. Logra un sólido rendimiento en la clasificación multilingüe MTEB (puntuación de 64.33) y demuestra resultados excelentes en diversas tareas, incluida la recuperación de Text, la recuperación de código, la clasificación de Text, la agrupación y la minería de bitextos. El modelo ofrece dimensiones vectoriales flexibles (de 32 a 1024) y capacidades sensibles a instrucciones para un rendimiento mejorado en tareas y escenarios específicos, lo que lo convierte en una opción ideal para aplicaciones que priorizan tanto la eficiencia como la eficacia
Serverless disponible
Ejecute consultas de forma inmediata y pague solo por el uso
Precio de Input
$
0.01
/ M Tokens
Metadatos
Especificación
Estado
Available
Arquitectura
Dense Transformer
Calibrado
Sí
Mezcla de expertos
No
Parámetros totales
1B
Parámetros activados
0.6B
Razonamiento
No
Precisión
FP8
Longitud del contexto
33K
Tokens máximos
Funcionalidades admitidas
Serverless
Compatible
Serverless LoRA
No compatible
Ajuste fino
No compatible
Embeddings
Compatible
Rerankers
No compatible
Soporte para Input de Image
No compatible
JSON Mode
No compatible
Outputs estructuradas
No compatible
Herramientas
No compatible
Finalización de Fim
No compatible
Completado de prefijo de Chat
No compatible
Comparar con otros modelos
Descubre cómo se compara este modelo con otros.

Qwen
chat
Qwen3-VL-32B-Instruct
Contexto total:
262K
Output máx.:
262K
Input:
$
0.2
/ M Tokens
Output:
$
0.6
/ M Tokens

Qwen
chat
Qwen3-VL-32B-Thinking
Contexto total:
262K
Output máx.:
262K
Input:
$
0.2
/ M Tokens
Output:
$
1.5
/ M Tokens

Qwen
chat
Qwen3-VL-8B-Instruct
Contexto total:
262K
Output máx.:
262K
Input:
$
0.18
/ M Tokens
Output:
$
0.68
/ M Tokens

Qwen
chat
Qwen3-VL-8B-Thinking
Contexto total:
262K
Output máx.:
262K
Input:
$
0.18
/ M Tokens
Output:
$
2.0
/ M Tokens

Qwen
chat
Qwen3-VL-235B-A22B-Instruct
Contexto total:
262K
Output máx.:
262K
Input:
$
0.3
/ M Tokens
Output:
$
1.5
/ M Tokens

Qwen
chat
Qwen3-VL-235B-A22B-Thinking
Contexto total:
262K
Output máx.:
262K
Input:
$
0.45
/ M Tokens
Output:
$
3.5
/ M Tokens

Qwen
chat
Qwen3-VL-30B-A3B-Instruct
Contexto total:
262K
Output máx.:
262K
Input:
$
0.29
/ M Tokens
Output:
$
1.0
/ M Tokens

Qwen
chat
Qwen3-VL-30B-A3B-Thinking
Contexto total:
262K
Output máx.:
262K
Input:
$
0.29
/ M Tokens
Output:
$
1.0
/ M Tokens

Qwen
image-to-video
Wan2.2-I2V-A14B
$
0.29
/ Video
