關於GLM-Z1-Rumination-32B-0414
GLM-Z1-Rumination-32B-0414 是一個具有反思能力的深度推理模型(以 OpenAI 的深度研究作為基準)。與典型的深度思考模型不同,反思模型採用更長時間的深度思考來解決更多開放性和複雜的問題(例如,撰寫兩個城市的 AI 發展比較分析及其未來發展計劃)。反思模型在其深度思考過程中整合了搜索工具以處理複雜任務,並通過利用多重基於規則的獎勵來指導和延伸端到端強化學習的訓練。Z1-Rumination 在研究型寫作和複雜檢索任務中顯示出顯著的改善。模型支持完整的研究週期,包括“獨立提出問題—搜索資訊—構建分析—完成任務”,並默認包含如搜索、點擊、打開和完成等功能呼叫,使其能夠更好地應對需要外部資訊的複雜問題。
元數據
規格
狀態
Deprecated
架構
經過校準的
否
專家並行
否
總參數
32B
啟用的參數
推理
否
精度
FP8
上下文長度
33K
最大輸出長度
與其他模型比較
看看這個模型與其他模型的對比如何。

Z.ai
GLM-4.7
總上下文:
205K
最大輸出:
205K
輸入:
$
0.42
/ M Tokens
輸出:
$
2.2
/ M Tokens

Z.ai
chat
GLM-4.6V
總上下文:
131K
最大輸出:
131K
輸入:
$
0.3
/ M Tokens
輸出:
$
0.9
/ M Tokens

Z.ai
chat
GLM-4.6
總上下文:
205K
最大輸出:
205K
輸入:
$
0.39
/ M Tokens
輸出:
$
1.9
/ M Tokens

Z.ai
chat
GLM-4.5-Air
總上下文:
131K
最大輸出:
131K
輸入:
$
0.14
/ M Tokens
輸出:
$
0.86
/ M Tokens

Z.ai
chat
GLM-4.5V
總上下文:
66K
最大輸出:
66K
輸入:
$
0.14
/ M Tokens
輸出:
$
0.86
/ M Tokens

Z.ai
chat
GLM-4.1V-9B-Thinking
總上下文:
66K
最大輸出:
66K
輸入:
$
0.035
/ M Tokens
輸出:
$
0.14
/ M Tokens

Z.ai
chat
GLM-Z1-32B-0414
總上下文:
131K
最大輸出:
131K
輸入:
$
0.14
/ M Tokens
輸出:
$
0.57
/ M Tokens

Z.ai
chat
GLM-4-32B-0414
總上下文:
33K
最大輸出:
33K
輸入:
$
0.27
/ M Tokens
輸出:
$
0.27
/ M Tokens

Z.ai
chat
GLM-Z1-9B-0414
總上下文:
131K
最大輸出:
131K
輸入:
$
0.086
/ M Tokens
輸出:
$
0.086
/ M Tokens
