정보에 대해서Kimi-K2-Thinking
Kimi K2 Thinking은 최신의 가장 능력 있는 오픈 소스 사고 모델입니다. Kimi K2부터 시작하여 단계별로 추론하면서 도구를 동적으로 호출하는 사고 에이전트로 구축했습니다. 이는 인간의 최후 시험 (HLE), BrowseComp 및 기타 벤치마크에서 새로운 최첨단을 설정하며, 다단계 추론 깊이를 극적으로 확장하고 200–300번의 연속 호출에 걸쳐 안정적인 도구 사용을 유지합니다. 동시에 K2 Thinking은 262k 컨텍스트 윈도우를 갖춘 네이티브 INT4 양자화 Model로, Inference 대기 시간 및 GPU 메모리 사용에서 무손실 감소를 달성합니다.
사용 가능한 Serverless
쿼리를 즉시 실행하고 사용한 만큼만 지불하세요.
$
0.55
/
$
2.5
1M 토큰당 (Input/Output)
메타데이터
사양
주
Available
건축
교정된
네
전문가의 혼합
네
총 매개변수
1000B
활성화된 매개변수
32B
추론
아니요
Precision
FP8
콘텍스트 길이
262K
Max Tokens
262K
지원됨 기능
Serverless
지원됨
Serverless LoRA
지원하지 않음
Fine-tuning
지원하지 않음
Embedding
지원하지 않음
Rerankers
지원하지 않음
지원 Image Input
지원하지 않음
JSON Mode
지원됨
구조화된 Outputs
지원하지 않음
도구
지원됨
Fim Completion
지원하지 않음
Chat Prefix Completion
지원됨
다른 모델과 비교
이 Model이 다른 것들과 어떻게 비교되는지 보세요.

Moonshot AI
chat
Kimi-K2.5
출시일: 2026. 1. 30.
Total Context:
262K
Max output:
262K
Input:
$
0.55
/ M Tokens
Output:
$
3.0
/ M Tokens

Moonshot AI
chat
Kimi-K2-Thinking
출시일: 2025. 11. 7.
Total Context:
262K
Max output:
262K
Input:
$
0.55
/ M Tokens
Output:
$
2.5
/ M Tokens

Moonshot AI
chat
Kimi-K2-Instruct-0905
출시일: 2025. 9. 8.
Total Context:
262K
Max output:
262K
Input:
$
0.4
/ M Tokens
Output:
$
2.0
/ M Tokens

Moonshot AI
chat
Kimi-K2-Instruct
출시일: 2025. 7. 13.
Total Context:
131K
Max output:
131K
Input:
$
0.58
/ M Tokens
Output:
$
2.29
/ M Tokens

Moonshot AI
chat
Kimi-Dev-72B
출시일: 2025. 6. 19.
Total Context:
131K
Max output:
131K
Input:
$
0.29
/ M Tokens
Output:
$
1.15
/ M Tokens
