Ling-flash-2.0

Ling-flash-2.0

inclusionAI/Ling-flash-2.0

Acerca de Ling-flash-2.0

Ling-flash-2.0 es un modelo de lenguaje de inclusionAI con un total de 100.000 millones de parámetros, de los cuales 6.100 millones se activan por token (4.800 millones que no son de Embedding). Como parte de la serie de arquitectura Ling 2.0, está diseñado como un modelo de Mezcla de Expertos (MoE) ligero pero potente. Su objetivo es ofrecer un rendimiento comparable o incluso superior al de los modelos densos de nivel 40B y otros modelos MoE más grandes, pero con un número de parámetros activos significativamente menor. El modelo representa una estrategia centrada en lograr un alto rendimiento y eficiencia a través de un diseño arquitectónico y métodos de entrenamiento extremos

Serverless disponible

Ejecute consultas de forma inmediata y pague solo por el uso

Precio de Input

$

0.14

/ M Tokens

Precio de Output

$

0.57

/ M Tokens

Metadatos

Creado el

Licencia

MIT LICENSE

Proveedor

inclusionAI

HuggingFace

Especificación

Estado

Available

Arquitectura

Mixture of Experts

Calibrado

No

Mezcla de expertos

Parámetros totales

100B

Parámetros activados

6.1B

Razonamiento

No

Precisión

FP8

Longitud del contexto

131K

Tokens máximos

131K

Funcionalidades admitidas

Serverless

Compatible

Serverless LoRA

No compatible

Ajuste fino

No compatible

Embeddings

No compatible

Rerankers

No compatible

Soporte para Input de Image

No compatible

JSON Mode

Compatible

Outputs estructuradas

No compatible

Herramientas

Compatible

Finalización de Fim

No compatible

Completado de prefijo de Chat

Compatible

¿Listo para acelerar tu desarrollo de IA?

¿Listo para acelerar tu desarrollo de IA?

¿Listo para acelerar tu desarrollo de IA?

© 2026 SiliconFlow

© 2026 SiliconFlow

© 2026 SiliconFlow