Hunyuan-A13B-Instruct
Acerca de Hunyuan-A13B-Instruct
Hunyuan-A13B-Instruct activa solo 13 B de sus 80 B de parámetros, pero iguala a LLMs mucho más grandes en los principales benchmarks. Ofrece un razonamiento híbrido: modo "rápido" de baja latencia o modo "lento" de alta precisión, intercambiables por llamada. Un contexto nativo de 256 K-tokens le permite digerir documentos del tamaño de un libro sin degradación. Las habilidades de agente están ajustadas para el liderazgo en BFCL-v3, τ-Bench y C3-Bench, lo que lo convierte en un excelente motor para asistentes autónomos. La tecnología Grouped Query Attention junto con la cuantificación multiformato ofrece una inferencia ligera en memoria y eficiente en GPU para implementaciones en el mundo real, con soporte multilingüe integrado y una sólida alineación de seguridad para aplicaciones de nivel empresarial.
Serverless disponible
Ejecute consultas de forma inmediata y pague solo por el uso
Precio de Input
$
0.14
/ M Tokens
Precio de Output
$
0.57
/ M Tokens
Metadatos
Especificación
Estado
Available
Arquitectura
Mixture of Experts
Calibrado
Sí
Mezcla de expertos
Sí
Parámetros totales
80B
Parámetros activados
13B
Razonamiento
No
Precisión
FP8
Longitud del contexto
131K
Tokens máximos
131K
Funcionalidades admitidas
Serverless
Compatible
Serverless LoRA
No compatible
Ajuste fino
No compatible
Embeddings
No compatible
Rerankers
No compatible
Soporte para Input de Image
No compatible
JSON Mode
Compatible
Outputs estructuradas
No compatible
Herramientas
No compatible
Finalización de Fim
No compatible
Completado de prefijo de Chat
No compatible
Comparar con otros modelos
Descubre cómo se compara este modelo con otros.

Tencent
chat
Hunyuan-MT-7B
Contexto total:
33K
Output máx.:
33K
Input:
$
0.0
/ M Tokens
Output:
$
0.0
/ M Tokens

Tencent
chat
Hunyuan-A13B-Instruct
Contexto total:
131K
Output máx.:
131K
Input:
$
0.14
/ M Tokens
Output:
$
0.57
/ M Tokens

Tencent
chat
Hy3
Contexto total:
262K
Output máx.:
262K
Input:
$
0.132
/ M Tokens
Output:
$
0.528
/ M Tokens

Tencent
chat
Hy3-preview
Contexto total:
262K
Output máx.:
262K
Input:
$
0.066
/ M Tokens
Output:
$
0.26
/ M Tokens
