Qwen3-235B-A22B-Instruct-2507
Tentang Qwen3-235B-A22B-Instruct-2507
Qwen3-235B-A22B-Instruct-2507 adalah model bahasa besar Mixture-of-Experts (MoE) unggulan dari seri Qwen3, yang dikembangkan oleh tim Qwen dari Alibaba Cloud. Model ini memiliki total 235 miliar parameter, dengan 22 miliar yang diaktifkan per forward pass. Ini dirilis sebagai versi terbaru dari mode non-berpikir Qwen3-235B-A22B, dengan peningkatan signifikan dalam kemampuan umum seperti mengikuti instruksi, penalaran logis, pemahaman Text, matematika, sains, pemrograman, dan penggunaan alat. Selain itu, model ini memberikan peningkatan besar dalam cakupan pengetahuan long-tail di berbagai bahasa dan menunjukkan perbaikan yang signifikan dalam keselarasan dengan preferensi pengguna dalam tugas yang subjektif dan terbuka, memungkinkan tanggapan yang lebih membantu dan penghasilan Text berkualitas tinggi. Yang penting, model ini mendukung native window konteks 256K (262,144 tokens) yang luas, yang meningkatkan kemampuannya untuk pemahaman konteks panjang. Versi ini secara eksklusif mendukung mode non-berpikir dan tidak menghasilkan blok <think>, yang bertujuan untuk memberikan tanggapan yang lebih efisien dan tepat untuk tugas seperti tanya jawab langsung dan pengambilan pengetahuan.
Tersedia Serverless
Jalankan kueri segera, bayar hanya untuk penggunaan
$
0.09
/
$
0.6
Per 1M Token (Input/Output)
Metadata
Spesifikasi
Negara
Available
Arsitektur
Terkalibrasi
Ya
Campuran Ahli
Ya
Total Parameter
235B
Parameter yang Diaktifkan
22B
Penalaran
Tidak
Precision
FP8
Text panjang konteks
262K
Max Tokens
262K
Didukung Keberfungsian
Serverless
didukung
Serverless LoRA
Tidak didukung
Fine-tuning
Tidak didukung
Embeddings
Tidak didukung
Rerankers
Tidak didukung
Dukung Image Input
Tidak didukung
JSON Mode
didukung
Output Terstruktur
Tidak didukung
Alat
didukung
Fim Completion
Tidak didukung
Chat Prefix Completion
didukung
Bandingkan dengan Model Lain
Lihat bagaimana model ini dibandingkan dengan yang lain.

Qwen
chat
Qwen3-VL-32B-Instruct
Dirilis pada: 21 Okt 2025
Total Context:
262K
Max output:
262K
Input:
$
0.2
/ M Tokens
Output:
$
0.6
/ M Tokens

Qwen
chat
Qwen3-VL-32B-Thinking
Dirilis pada: 21 Okt 2025
Total Context:
262K
Max output:
262K
Input:
$
0.2
/ M Tokens
Output:
$
1.5
/ M Tokens

Qwen
chat
Qwen3-VL-8B-Instruct
Dirilis pada: 15 Okt 2025
Total Context:
262K
Max output:
262K
Input:
$
0.18
/ M Tokens
Output:
$
0.68
/ M Tokens

Qwen
chat
Qwen3-VL-8B-Thinking
Dirilis pada: 15 Okt 2025
Total Context:
262K
Max output:
262K
Input:
$
0.18
/ M Tokens
Output:
$
2.0
/ M Tokens

Qwen
chat
Qwen3-VL-235B-A22B-Instruct
Dirilis pada: 4 Okt 2025
Total Context:
262K
Max output:
262K
Input:
$
0.3
/ M Tokens
Output:
$
1.5
/ M Tokens

Qwen
chat
Qwen3-VL-235B-A22B-Thinking
Dirilis pada: 4 Okt 2025
Total Context:
262K
Max output:
262K
Input:
$
0.45
/ M Tokens
Output:
$
3.5
/ M Tokens

Qwen
chat
Qwen3-VL-30B-A3B-Instruct
Dirilis pada: 5 Okt 2025
Total Context:
262K
Max output:
262K
Input:
$
0.29
/ M Tokens
Output:
$
1.0
/ M Tokens

Qwen
chat
Qwen3-VL-30B-A3B-Thinking
Dirilis pada: 11 Okt 2025
Total Context:
262K
Max output:
262K
Input:
$
0.29
/ M Tokens
Output:
$
1.0
/ M Tokens

Qwen
image-to-video
Wan2.2-I2V-A14B
Dirilis pada: 13 Agu 2025
$
0.29
/ Video
