Ling-flash-2.0
Acerca de Ling-flash-2.0
Ling-flash-2.0 es un modelo de lenguaje de inclusionAI con un total de 100.000 millones de parámetros, de los cuales 6.100 millones se activan por token (4.800 millones que no son de Embedding). Como parte de la serie de arquitectura Ling 2.0, está diseñado como un modelo de Mezcla de Expertos (MoE) ligero pero potente. Su objetivo es ofrecer un rendimiento comparable o incluso superior al de los modelos densos de nivel 40B y otros modelos MoE más grandes, pero con un número de parámetros activos significativamente menor. El modelo representa una estrategia centrada en lograr un alto rendimiento y eficiencia a través de un diseño arquitectónico y métodos de entrenamiento extremos
Serverless disponible
Ejecute consultas de forma inmediata y pague solo por el uso
Precio de Input
$
0.14
/ M Tokens
Precio de Output
$
0.57
/ M Tokens
Metadatos
Especificación
Estado
Available
Arquitectura
Mixture of Experts
Calibrado
No
Mezcla de expertos
Sí
Parámetros totales
100B
Parámetros activados
6.1B
Razonamiento
No
Precisión
FP8
Longitud del contexto
131K
Tokens máximos
131K
Funcionalidades admitidas
Serverless
Compatible
Serverless LoRA
No compatible
Ajuste fino
No compatible
Embeddings
No compatible
Rerankers
No compatible
Soporte para Input de Image
No compatible
JSON Mode
Compatible
Outputs estructuradas
No compatible
Herramientas
Compatible
Finalización de Fim
No compatible
Completado de prefijo de Chat
Compatible
Comparar con otros modelos
Descubre cómo se compara este modelo con otros.

inclusionAI
chat
Ling-flash-2.0
Contexto total:
131K
Output máx.:
131K
Input:
$
0.14
/ M Tokens
Output:
$
0.57
/ M Tokens

inclusionAI
chat
Ling-mini-2.0
Contexto total:
131K
Output máx.:
131K
Input:
$
0.07
/ M Tokens
Output:
$
0.28
/ M Tokens

inclusionAI
chat
Ring-flash-2.0
Contexto total:
131K
Output máx.:
131K
Input:
$
0.14
/ M Tokens
Output:
$
0.57
/ M Tokens

inclusionAI
chat
Ring-1T
Contexto total:
131K
Output máx.:
Input:
$
0.57
/ M Tokens
Output:
$
2.28
/ M Tokens

inclusionAI
chat
Ling-1T
Contexto total:
131K
Output máx.:
Input:
$
0.57
/ M Tokens
Output:
$
2.28
/ M Tokens
