MiniMax-M3
Acerca de MiniMax-M3
MiniMax-M3 es el modelo de codificación Multimodal y agéntico de vanguardia de MiniMax, creado sobre la arquitectura de atención dispersa de MiniMax (MSA). Soporta una ventana de contexto de hasta 1M de tokens y acepta Inputs de Video e Image. El modelo está diseñado para la generación de código, flujos de trabajo agénticos, uso de herramientas, comprensión de contexto largo y razonamiento multipaso, mostrando un fuerte rendimiento en pruebas de rendimiento como SWE-Bench Pro, Terminal-Bench 2.1 y MCP Atlas.
Serverless disponible
Ejecute consultas de forma inmediata y pague solo por el uso
Precio de Input
$
0.3
/ M Tokens
Lectura de caché
$
0.06
/ M Tokens
Precio de Output
$
1.2
/ M Tokens
Metadatos
Especificación
Estado
Available
Arquitectura
Calibrado
No
Mezcla de expertos
No
Parámetros totales
-1B
Parámetros activados
Razonamiento
No
Precisión
FP8
Longitud del contexto
1049K
Tokens máximos
131K
Funcionalidades admitidas
Serverless
Compatible
Serverless LoRA
No compatible
Ajuste fino
No compatible
Embeddings
No compatible
Rerankers
No compatible
Soporte para Input de Image
Compatible
JSON Mode
Compatible
Outputs estructuradas
No compatible
Herramientas
Compatible
Finalización de Fim
No compatible
Completado de prefijo de Chat
Compatible
Comparar con otros modelos
Descubre cómo se compara este modelo con otros.

MiniMaxAI
chat
MiniMax-M2.1
Contexto total:
197K
Output máx.:
131K
Input:
$
0.29
/ M Tokens
Output:
$
1.2
/ M Tokens

MiniMaxAI
chat
MiniMax-M2
Contexto total:
197K
Output máx.:
131K
Input:
$
0.3
/ M Tokens
Output:
$
1.2
/ M Tokens

MiniMaxAI
chat
MiniMax-M1-80k
Contexto total:
131K
Output máx.:
131K
Input:
$
0.55
/ M Tokens
Output:
$
2.2
/ M Tokens

MiniMaxAI
chat
MiniMax-M3
Contexto total:
1049K
Output máx.:
131K
Input:
$
0.3
/ M Tokens
Output:
$
1.2
/ M Tokens

MiniMaxAI
chat
MiniMax-M2.5
Contexto total:
197K
Output máx.:
131K
Input:
$
0.3
/ M Tokens
Output:
$
1.2
/ M Tokens
