Qwen3-Omni-30B-A3B-Instruct
Acerca de Qwen3-Omni-30B-A3B-Instruct
Qwen3-Omni-30B-A3B-Instruct es un miembro de la serie Qwen3 más reciente del equipo Qwen de Alibaba. Es un modelo de Mezcla de Expertos (MoE) con un total de 30.000 millones de parámetros y 3.000 millones de parámetros activos, lo que reduce eficazmente los costes de inferencia al mismo tiempo que mantiene un potente rendimiento. El modelo ha sido entrenado con datos multilingües, de múltiples fuentes y de alta calidad
Explore cómo las capacidades avanzadas de Multimodal y multilingües de Qwen3-Omni-30B-A3B-Instruct pueden resolver problemas complejos del mundo real.
Creación de contenido Multimodal
Genere y perfeccione contenido diverso (Text, imágenes, Audio, Video) garantizando la coherencia y la consistencia de la marca en todos los formatos.
Ejemplo de caso de uso:
"A partir de un informe de Text, el modelo generó un guion de Video de marketing, seleccionó imágenes de stock relevantes y sintetizó una voz en off de sonido natural en tres idiomas, lo que redujo significativamente el tiempo de producción."
Soporte multilingüe en tiempo real
Ofrezca asistencia al cliente instantánea y de sonido natural en múltiples idiomas y modalidades, incluidas las de voz, Chat y análisis de Video.
Ejemplo de caso de uso:
"Un cliente que hablaba francés mostró un dispositivo defectuoso a través de una llamada de Video; la IA comprendió al instante el problema, proporcionó pasos verbales para la resolución de problemas en francés y mostró los diagramas correspondientes."
Análisis avanzado de medios
Extraiga información profunda y procesable de vastos archivos de Audio y Video, identificando objetos, transcribiendo discursos y detectando eventos complejos.
Ejemplo de caso de uso:
"Indexó automáticamente horas de grabaciones de seguridad, identificando modelos de vehículos específicos, transcribiendo conversaciones en entornos ruidosos y señalando patrones de sonido inusuales como la rotura de cristales."
Aprendizaje y formación interactivos
Cree experiencias de aprendizaje dinámicas y personalizadas con comentarios del tipo Multimodal, resolución de problemas y entrega de contenido adaptativo.
Ejemplo de caso de uso:
"Un estudiante de ingeniería subió un diagrama de circuito escrito a mano; la IA explicó verbalmente los fallos de diseño, le guio a través de las correcciones y le proporcionó comentarios en tiempo real sobre su dibujo revisado."
Metadatos
Especificación
Estado
Deprecated
Arquitectura
Multimodal MoE
Calibrado
No
Mezcla de expertos
Sí
Parámetros totales
30B
Parámetros activados
3B
Razonamiento
No
Precisión
FP8
Longitud del contexto
66K
Tokens máximos
66K
Comparar con otros modelos
Descubre cómo se compara este modelo con otros.

Qwen
chat
Qwen3-VL-32B-Instruct
Contexto total:
262K
Output máx.:
262K
Input:
$
0.2
/ M Tokens
Output:
$
0.6
/ M Tokens

Qwen
chat
Qwen3-VL-32B-Thinking
Contexto total:
262K
Output máx.:
262K
Input:
$
0.2
/ M Tokens
Output:
$
1.5
/ M Tokens

Qwen
chat
Qwen3-VL-8B-Instruct
Contexto total:
262K
Output máx.:
262K
Input:
$
0.18
/ M Tokens
Output:
$
0.68
/ M Tokens

Qwen
chat
Qwen3-VL-8B-Thinking
Contexto total:
262K
Output máx.:
262K
Input:
$
0.18
/ M Tokens
Output:
$
2.0
/ M Tokens

Qwen
chat
Qwen3-VL-235B-A22B-Instruct
Contexto total:
262K
Output máx.:
262K
Input:
$
0.3
/ M Tokens
Output:
$
1.5
/ M Tokens

Qwen
chat
Qwen3-VL-235B-A22B-Thinking
Contexto total:
262K
Output máx.:
262K
Input:
$
0.45
/ M Tokens
Output:
$
3.5
/ M Tokens

Qwen
chat
Qwen3-VL-30B-A3B-Instruct
Contexto total:
262K
Output máx.:
262K
Input:
$
0.29
/ M Tokens
Output:
$
1.0
/ M Tokens

Qwen
chat
Qwen3-VL-30B-A3B-Thinking
Contexto total:
262K
Output máx.:
262K
Input:
$
0.29
/ M Tokens
Output:
$
1.0
/ M Tokens

Qwen
image-to-video
Wan2.2-I2V-A14B
$
0.29
/ Video
