Qwen-Image-Edit
Acerca de Qwen-Image-Edit
Qwen-Image-Edit es la versión de edición de Image de Qwen-Image, lanzada por el equipo Qwen de Alibaba. Desarrollado sobre el modelo Qwen-Image de 20B, se ha entrenado aún más para ampliar sus capacidades únicas de renderizado de Text a tareas de edición de Image, lo que permite una edición precisa de Text dentro de las imágenes. Además, Qwen-Image-Edit utiliza una arquitectura innovadora que introduce la Image de Input tanto en Qwen2.5-VL (para el control semántico visual) como en un codificador VAE (para el control de la apariencia visual), logrando capacidades en la edición tanto semántica como de apariencia. Esto le permite admitir no solo ediciones de apariencia visual de bajo nivel, como agregar, eliminar o modificar elementos, sino también la edición semántica visual de alto nivel, como la creación de PI y la transferencia de estilo, que requieren mantener la consistencia semántica. El modelo ha logrado un rendimiento de vanguardia (SOTA) en múltiples evaluaciones de referencia públicas, lo que lo establece como un potente modelo base para la edición de imágenes.
Serverless disponible
Ejecute consultas de forma inmediata y pague solo por el uso
Precio
$
0.04
/ Image
Metadatos
Especificación
Estado
Available
Arquitectura
Qwen2.5-VL VAE
Calibrado
Sí
Mezcla de expertos
No
Parámetros totales
20B
Parámetros activados
20B
Razonamiento
No
Precisión
FP8
Longitud del contexto
0K
Tokens máximos
Funcionalidades admitidas
Serverless
Compatible
Serverless LoRA
No compatible
Ajuste fino
No compatible
Embeddings
No compatible
Rerankers
No compatible
Soporte para Input de Image
No compatible
JSON Mode
No compatible
Outputs estructuradas
No compatible
Herramientas
No compatible
Finalización de Fim
No compatible
Completado de prefijo de Chat
No compatible
Comparar con otros modelos
Descubre cómo se compara este modelo con otros.

Qwen
chat
Qwen3-VL-32B-Instruct
Contexto total:
262K
Output máx.:
262K
Input:
$
0.2
/ M Tokens
Output:
$
0.6
/ M Tokens

Qwen
chat
Qwen3-VL-32B-Thinking
Contexto total:
262K
Output máx.:
262K
Input:
$
0.2
/ M Tokens
Output:
$
1.5
/ M Tokens

Qwen
chat
Qwen3-VL-8B-Instruct
Contexto total:
262K
Output máx.:
262K
Input:
$
0.18
/ M Tokens
Output:
$
0.68
/ M Tokens

Qwen
chat
Qwen3-VL-8B-Thinking
Contexto total:
262K
Output máx.:
262K
Input:
$
0.18
/ M Tokens
Output:
$
2.0
/ M Tokens

Qwen
chat
Qwen3-VL-235B-A22B-Instruct
Contexto total:
262K
Output máx.:
262K
Input:
$
0.3
/ M Tokens
Output:
$
1.5
/ M Tokens

Qwen
chat
Qwen3-VL-235B-A22B-Thinking
Contexto total:
262K
Output máx.:
262K
Input:
$
0.45
/ M Tokens
Output:
$
3.5
/ M Tokens

Qwen
chat
Qwen3-VL-30B-A3B-Instruct
Contexto total:
262K
Output máx.:
262K
Input:
$
0.29
/ M Tokens
Output:
$
1.0
/ M Tokens

Qwen
chat
Qwen3-VL-30B-A3B-Thinking
Contexto total:
262K
Output máx.:
262K
Input:
$
0.29
/ M Tokens
Output:
$
1.0
/ M Tokens

Qwen
image-to-video
Wan2.2-I2V-A14B
$
0.29
/ Video
