Hunyuan-A13B-Instruct

Hunyuan-A13B-Instruct

tencent/Hunyuan-A13B-Instruct

Acerca de Hunyuan-A13B-Instruct

Hunyuan-A13B-Instruct activa solo 13 B de sus 80 B de parámetros, pero iguala a LLMs mucho más grandes en los principales benchmarks. Ofrece un razonamiento híbrido: modo "rápido" de baja latencia o modo "lento" de alta precisión, intercambiables por llamada. Un contexto nativo de 256 K-tokens le permite digerir documentos del tamaño de un libro sin degradación. Las habilidades de agente están ajustadas para el liderazgo en BFCL-v3, τ-Bench y C3-Bench, lo que lo convierte en un excelente motor para asistentes autónomos. La tecnología Grouped Query Attention junto con la cuantificación multiformato ofrece una inferencia ligera en memoria y eficiente en GPU para implementaciones en el mundo real, con soporte multilingüe integrado y una sólida alineación de seguridad para aplicaciones de nivel empresarial.

Serverless disponible

Ejecute consultas de forma inmediata y pague solo por el uso

Precio de Input

$

0.14

/ M Tokens

Precio de Output

$

0.57

/ M Tokens

Metadatos

Creado el

Licencia

-

Proveedor

Tencent

Especificación

Estado

Available

Arquitectura

Mixture of Experts

Calibrado

Mezcla de expertos

Parámetros totales

80B

Parámetros activados

13B

Razonamiento

No

Precisión

FP8

Longitud del contexto

131K

Tokens máximos

131K

Funcionalidades admitidas

Serverless

Compatible

Serverless LoRA

No compatible

Ajuste fino

No compatible

Embeddings

No compatible

Rerankers

No compatible

Soporte para Input de Image

No compatible

JSON Mode

Compatible

Outputs estructuradas

No compatible

Herramientas

No compatible

Finalización de Fim

No compatible

Completado de prefijo de Chat

No compatible

¿Listo para acelerar tu desarrollo de IA?

¿Listo para acelerar tu desarrollo de IA?

¿Listo para acelerar tu desarrollo de IA?

© 2026 SiliconFlow

© 2026 SiliconFlow

© 2026 SiliconFlow