關於Qwen3-30B-A3B-Thinking-2507
Qwen3-30B-A3B-Thinking-2507 是阿里巴巴 Qwen 團隊發布的 Qwen3 系列中最新的思考模型。作為一個專家混合體系(MoE)模型,它擁有305億個總參數和33億個活躍參數,專注於提高處理複雜任務的能力。該模型在推理任務上表現出顯著的改進,包括邏輯推理、數學、科學、編碼和通常需要人類專業知識的學術基準測試。它還在指令跟隨、工具使用、文本生成和符合人類偏好等一般能力方面顯示出顯著更好的性能。該模型本地支持256K長上下文理解能力,並且可以擴展到100萬個標記。此版本專門為“思考模式”設計,以通過逐步推理解決極其複雜的問題,並在代理能力方面也表現出色。
可用的無伺服器
立即運行查詢,僅按使用量付費
$
0.09
/
$
0.3
每百萬 Tokens(輸入/輸出)
元數據
規格
狀態
可用
架構
經過校準的
不
專家並行
是
總參數
30B
啟用的參數
3.3B
推理
不
精度
FP8
上下文長度
262K
最大輸出長度
131K
支援的功能
無伺服器
支持
無伺服器的 LoRA
不支持
微調
不支持
向量嵌入
不支持
重排序
不支持
支援圖片輸入
不支持
JSON 模式
支持
結構化輸出
不支持
工具
支持
中間填充補全
不支持
聊天前綴補全
不支持
與其他模型比較
看看這個模型與其他模型的對比如何。

Qwen
聊天
Qwen3-VL-32B-Instruct
發行日期:2025年10月21日
總上下文:
262K
最大輸出:
262K
輸入:
$
0.2
/ M Tokens
輸出:
$
0.6
/ M Tokens

Qwen
聊天
Qwen3-VL-32B-Thinking
發行日期:2025年10月21日
總上下文:
262K
最大輸出:
262K
輸入:
$
0.2
/ M Tokens
輸出:
$
1.5
/ M Tokens

Qwen
聊天
Qwen3-VL-8B-Instruct
發行日期:2025年10月15日
總上下文:
262K
最大輸出:
262K
輸入:
$
0.18
/ M Tokens
輸出:
$
0.68
/ M Tokens

Qwen
聊天
Qwen3-VL-8B-Thinking
發行日期:2025年10月15日
總上下文:
262K
最大輸出:
262K
輸入:
$
0.18
/ M Tokens
輸出:
$
2.0
/ M Tokens

Qwen
聊天
Qwen3-VL-235B-A22B-Instruct
發行日期:2025年10月4日
總上下文:
262K
最大輸出:
262K
輸入:
$
0.3
/ M Tokens
輸出:
$
1.5
/ M Tokens

Qwen
聊天
Qwen3-VL-235B-A22B-Thinking
發行日期:2025年10月4日
總上下文:
262K
最大輸出:
262K
輸入:
$
0.45
/ M Tokens
輸出:
$
3.5
/ M Tokens

Qwen
聊天
Qwen3-VL-30B-A3B-Instruct
發行日期:2025年10月5日
總上下文:
262K
最大輸出:
262K
輸入:
$
0.29
/ M Tokens
輸出:
$
1.0
/ M Tokens

Qwen
聊天
Qwen3-VL-30B-A3B-Thinking
發行日期:2025年10月11日
總上下文:
262K
最大輸出:
262K
輸入:
$
0.29
/ M Tokens
輸出:
$
1.0
/ M Tokens

Qwen
影像轉影片
Wan2.2-I2V-A14B
發行日期:2025年8月13日
總上下文:
0K
最大輸出:
輸入:
$
/ 影片
輸出:
$
/ 影片
