Qwen-Image
Acerca de Qwen-Image
Qwen-Image es un modelo base de generación de imágenes lanzado por el equipo de Alibaba Qwen que cuenta con 20 000 millones de parámetros. El modelo ha logrado avances significativos en la renderización de texto complejo y en la edición precisa de imágenes, destacando especialmente en la generación de imágenes con texto en chino e inglés de alta fidelidad. Qwen-Image es capaz de gestionar diseños de varias líneas y texto a nivel de párrafo, manteniendo al mismo tiempo la coherencia del diseño y la armonía contextual en las imágenes generadas. Más allá de su superior capacidad de renderización de texto, el modelo es compatible con una amplia gama de estilos artísticos, desde escenas fotorrealistas hasta la estética del anime, adaptándose de forma fluida a diversas indicaciones creativas. También posee potentes capacidades de comprensión y edición de imágenes, lo que permite realizar operaciones avanzadas como la transferencia de estilo, la inserción o eliminación de objetos, la mejora de detalles, la edición de texto e incluso la manipulación de la pose humana, con el objetivo de ser un modelo base integral para la creación y manipulación visual inteligente donde convergen el lenguaje, el diseño y las imágenes.
Serverless disponible
Ejecute consultas de forma inmediata y pague solo por el uso
Precio
$
0.02
/ Image
Metadatos
Especificación
Estado
Available
Arquitectura
Diffusion Model
Calibrado
No
Mezcla de expertos
No
Parámetros totales
20B
Parámetros activados
20B
Razonamiento
No
Precisión
FP8
Longitud del contexto
0K
Tokens máximos
Funcionalidades admitidas
Serverless
Compatible
Serverless LoRA
No compatible
Ajuste fino
No compatible
Embeddings
No compatible
Rerankers
No compatible
Soporte para Input de Image
No compatible
JSON Mode
No compatible
Outputs estructuradas
No compatible
Herramientas
No compatible
Finalización de Fim
No compatible
Completado de prefijo de Chat
No compatible
Comparar con otros modelos
Descubre cómo se compara este modelo con otros.

Qwen
chat
Qwen3-VL-32B-Instruct
Contexto total:
262K
Output máx.:
262K
Input:
$
0.2
/ M Tokens
Output:
$
0.6
/ M Tokens

Qwen
chat
Qwen3-VL-32B-Thinking
Contexto total:
262K
Output máx.:
262K
Input:
$
0.2
/ M Tokens
Output:
$
1.5
/ M Tokens

Qwen
chat
Qwen3-VL-8B-Instruct
Contexto total:
262K
Output máx.:
262K
Input:
$
0.18
/ M Tokens
Output:
$
0.68
/ M Tokens

Qwen
chat
Qwen3-VL-8B-Thinking
Contexto total:
262K
Output máx.:
262K
Input:
$
0.18
/ M Tokens
Output:
$
2.0
/ M Tokens

Qwen
chat
Qwen3-VL-235B-A22B-Instruct
Contexto total:
262K
Output máx.:
262K
Input:
$
0.3
/ M Tokens
Output:
$
1.5
/ M Tokens

Qwen
chat
Qwen3-VL-235B-A22B-Thinking
Contexto total:
262K
Output máx.:
262K
Input:
$
0.45
/ M Tokens
Output:
$
3.5
/ M Tokens

Qwen
chat
Qwen3-VL-30B-A3B-Instruct
Contexto total:
262K
Output máx.:
262K
Input:
$
0.29
/ M Tokens
Output:
$
1.0
/ M Tokens

Qwen
chat
Qwen3-VL-30B-A3B-Thinking
Contexto total:
262K
Output máx.:
262K
Input:
$
0.29
/ M Tokens
Output:
$
1.0
/ M Tokens

Qwen
image-to-video
Wan2.2-I2V-A14B
$
0.29
/ Video
