

모델 비교
GLM-5
대
MiniMax-M2
2026. 2. 15.

가격
Input
$
0.3
/ M Tokens
$
0.3
/ M Tokens
Output
$
2.55
/ M Tokens
$
1.2
/ M Tokens
메타데이터
사양
주
Available
Deprecated
건축
Mixture of Experts (MoE) with DeepSeek Sparse Attention (DSA) and asynchronous RL stack
Mixture of Experts
교정된
아니요
아니요
전문가의 혼합
네
네
총 매개변수
750B
230B
활성화된 매개변수
40B
10B
추론
아니요
아니요
Precision
FP8
FP8
콘텍스트 길이
205K
197K
Max Tokens
131K
131K
지원됨 기능
Serverless
지원됨
지원됨
Serverless LoRA
지원하지 않음
지원하지 않음
Fine-tuning
지원하지 않음
지원하지 않음
Embedding
지원하지 않음
지원하지 않음
Rerankers
지원하지 않음
지원하지 않음
지원 Image Input
지원하지 않음
지원하지 않음
JSON Mode
지원하지 않음
지원됨
구조화된 Outputs
지원하지 않음
지원하지 않음
도구
지원됨
지원됨
Fim Completion
지원하지 않음
지원하지 않음
Chat Prefix Completion
지원하지 않음
지원됨



