关于GLM-Z1-Rumination-32B-0414
GLM-Z1-Rumination-32B-0414 是一个具有反思能力的深度推理模型(以 OpenAI 的 Deep Research 为基准)。与典型的深度思考模型不同,反思模型采用较长的深度思考时间来解决更开放和复杂的问题(例如,撰写两座城市的 AI 发展比较分析及其未来发展计划)。反思模型在深度思考过程中集成了搜索工具来处理复杂任务,并通过利用多项基于规则的奖励来指导和延长端到端强化学习进行训练。Z1-Rumination 在研究风格写作和复杂检索任务方面表现出显著改进。模型支持“独立提出问题—搜索信息—构建分析—完成任务”的完整研究周期,并默认包括搜索、点击、打开和完成等函数调用,使其能够更好地处理需要外部信息的复杂问题。
元数据
规格
州
Deprecated
建筑
校准的
不
专家混合
不
总参数
32B
激活的参数
推理
不
精度
FP8
上下文长度
33K
最大输出长度
与其他模型进行比较
看看这个模型与其他模型相比表现如何。

Z.ai
GLM-4.7
上下文长度:
205K
最大输出长度:
205K
Input:
$
0.42
/ M Tokens
Output:
$
2.2
/ M Tokens

Z.ai
chat
GLM-4.6V
上下文长度:
131K
最大输出长度:
131K
Input:
$
0.3
/ M Tokens
Output:
$
0.9
/ M Tokens

Z.ai
chat
GLM-4.6
上下文长度:
205K
最大输出长度:
205K
Input:
$
0.39
/ M Tokens
Output:
$
1.9
/ M Tokens

Z.ai
chat
GLM-4.5-Air
上下文长度:
131K
最大输出长度:
131K
Input:
$
0.14
/ M Tokens
Output:
$
0.86
/ M Tokens

Z.ai
chat
GLM-4.5V
上下文长度:
66K
最大输出长度:
66K
Input:
$
0.14
/ M Tokens
Output:
$
0.86
/ M Tokens

Z.ai
chat
GLM-4.1V-9B-Thinking
上下文长度:
66K
最大输出长度:
66K
Input:
$
0.035
/ M Tokens
Output:
$
0.14
/ M Tokens

Z.ai
chat
GLM-Z1-32B-0414
上下文长度:
131K
最大输出长度:
131K
Input:
$
0.14
/ M Tokens
Output:
$
0.57
/ M Tokens

Z.ai
chat
GLM-4-32B-0414
上下文长度:
33K
最大输出长度:
33K
Input:
$
0.27
/ M Tokens
Output:
$
0.27
/ M Tokens

Z.ai
chat
GLM-Z1-9B-0414
上下文长度:
131K
最大输出长度:
131K
Input:
$
0.086
/ M Tokens
Output:
$
0.086
/ M Tokens
