정보에 대해서Qwen3-Next-80B-A3B-Thinking
Qwen3-Next-80B-A3B-Thinking은 Alibaba의 Qwen 팀에서 복잡한 추론 작업을 위해 특별히 설계된 차세대 기초 Model입니다. 이는 Gated DeltaNet과 Gated Attention을 결합한 Hybrid Attention 메커니즘과 고스파시티 혼합 전문가(MoE) 구조를 사용하여 궁극적인 훈련 및 Inference 효율성을 달성합니다. 800억 개의 매개변수를 가진 Sparse Model로, Inference 도중 약 30억 개의 매개변수만 활성화하여 계산 비용을 크게 줄이고, 32K token을 초과하는 장기 컨텍스트 작업에서 Qwen3-32B 모델보다 10배 이상의 처리량을 제공합니다. 이 'Thinking' 버전은 수학적 증명, 코드 합성, 논리적 분석, 계획과 같은 까다로운 다단계 문제에 최적화되어 있으며, 기본적으로 구조화된 'thinking' 트레이스를 Output 합니다. 성능 면에서, 더 높은 비용의 모델인 Qwen3-32B-Thinking을 능가했으며 여러 벤치마크에서 Gemini-2.5-Flash-Thinking을 능가했습니다.
사용 가능한 Serverless
쿼리를 즉시 실행하고 사용한 만큼만 지불하세요.
$
0.14
/
$
0.57
1M 토큰당 (Input/Output)
메타데이터
사양
주
Available
건축
교정된
아니요
전문가의 혼합
네
총 매개변수
80B
활성화된 매개변수
3B
추론
아니요
Precision
FP8
콘텍스트 길이
262K
Max Tokens
262K
지원됨 기능
Serverless
지원됨
Serverless LoRA
지원하지 않음
Fine-tuning
지원하지 않음
Embedding
지원하지 않음
Rerankers
지원하지 않음
지원 Image Input
지원하지 않음
JSON Mode
지원하지 않음
구조화된 Outputs
지원하지 않음
도구
지원됨
Fim Completion
지원하지 않음
Chat Prefix Completion
지원됨
다른 모델과 비교
이 Model이 다른 것들과 어떻게 비교되는지 보세요.

Qwen
chat
Qwen3-VL-32B-Instruct
출시일: 2025. 10. 21.
Total Context:
262K
Max output:
262K
Input:
$
0.2
/ M Tokens
Output:
$
0.6
/ M Tokens

Qwen
chat
Qwen3-VL-32B-Thinking
출시일: 2025. 10. 21.
Total Context:
262K
Max output:
262K
Input:
$
0.2
/ M Tokens
Output:
$
1.5
/ M Tokens

Qwen
chat
Qwen3-VL-8B-Instruct
출시일: 2025. 10. 15.
Total Context:
262K
Max output:
262K
Input:
$
0.18
/ M Tokens
Output:
$
0.68
/ M Tokens

Qwen
chat
Qwen3-VL-8B-Thinking
출시일: 2025. 10. 15.
Total Context:
262K
Max output:
262K
Input:
$
0.18
/ M Tokens
Output:
$
2.0
/ M Tokens

Qwen
chat
Qwen3-VL-235B-A22B-Instruct
출시일: 2025. 10. 4.
Total Context:
262K
Max output:
262K
Input:
$
0.3
/ M Tokens
Output:
$
1.5
/ M Tokens

Qwen
chat
Qwen3-VL-235B-A22B-Thinking
출시일: 2025. 10. 4.
Total Context:
262K
Max output:
262K
Input:
$
0.45
/ M Tokens
Output:
$
3.5
/ M Tokens

Qwen
chat
Qwen3-VL-30B-A3B-Instruct
출시일: 2025. 10. 5.
Total Context:
262K
Max output:
262K
Input:
$
0.29
/ M Tokens
Output:
$
1.0
/ M Tokens

Qwen
chat
Qwen3-VL-30B-A3B-Thinking
출시일: 2025. 10. 11.
Total Context:
262K
Max output:
262K
Input:
$
0.29
/ M Tokens
Output:
$
1.0
/ M Tokens

Qwen
image-to-video
Wan2.2-I2V-A14B
출시일: 2025. 8. 13.
$
0.29
/ Video
