Qwen3.5-35B-A3B

Qwen3.5-35B-A3B

Qwen/Qwen3.5-35B-A3B

Acerca de Qwen3.5-35B-A3B

Qwen3.5-35B-A3B es un modelo de lenguaje grande Multimodal nativo del equipo de Qwen, con 35B de parámetros totales y solo 3B activados. Cuenta con una arquitectura híbrida eficiente que combina Gated Delta Networks con Mixture-of-Experts (MoE) disperso, admitiendo de forma nativa una longitud de contexto de 262K ampliable hasta ~1M tokens. El modelo logra capacidades unificadas de lenguaje y Vision a través de un entrenamiento de fusión temprana, admitiendo la comprensión de Text, Image y Video con un sólido rendimiento en pruebas de rendimiento de razonamiento, codificación, agentes y comprensión visual. Se activa por defecto en modo de pensamiento, admite llamadas a herramientas y cubre 201 idiomas y dialectos

Serverless disponible

Ejecute consultas de forma inmediata y pague solo por el uso

Precio de Input

$

0.24

/ M Tokens

Precio de Output

$

1.8

/ M Tokens

Metadatos

Creado el

Licencia

APACHE-2.0

Proveedor

Qwen

HuggingFace

Especificación

Estado

Available

Arquitectura

Hybrid MoE

Calibrado

Mezcla de expertos

Parámetros totales

35B

Parámetros activados

3B

Razonamiento

No

Precisión

FP8

Longitud del contexto

262K

Tokens máximos

262K

Funcionalidades admitidas

Serverless

Compatible

Serverless LoRA

No compatible

Ajuste fino

No compatible

Embeddings

No compatible

Rerankers

No compatible

Soporte para Input de Image

Compatible

JSON Mode

Compatible

Outputs estructuradas

No compatible

Herramientas

Compatible

Finalización de Fim

No compatible

Completado de prefijo de Chat

No compatible

¿Listo para acelerar tu desarrollo de IA?

¿Listo para acelerar tu desarrollo de IA?

¿Listo para acelerar tu desarrollo de IA?

© 2026 SiliconFlow

© 2026 SiliconFlow

© 2026 SiliconFlow