GLM-Z1-Rumination-32B-0414

GLM-Z1-Rumination-32B-0414

关于GLM-Z1-Rumination-32B-0414

GLM-Z1-Rumination-32B-0414 是一个具有反思能力的深度推理模型(以 OpenAI 的 Deep Research 为基准)。与典型的深度思考模型不同,反思模型采用较长的深度思考时间来解决更开放和复杂的问题(例如,撰写两座城市的 AI 发展比较分析及其未来发展计划)。反思模型在深度思考过程中集成了搜索工具来处理复杂任务,并通过利用多项基于规则的奖励来指导和延长端到端强化学习进行训练。Z1-Rumination 在研究风格写作和复杂检索任务方面表现出显著改进。模型支持“独立提出问题—搜索信息—构建分析—完成任务”的完整研究周期,并默认包括搜索、点击、打开和完成等函数调用,使其能够更好地处理需要外部信息的复杂问题。

元数据

创建

许可证

MIT

提供者

Z.ai

规格

Deprecated

建筑

校准的

专家混合

总参数

32B

激活的参数

推理

精度

FP8

上下文长度

33K

最大输出长度

准备好 加速您的人工智能开发吗?

准备好 加速您的人工智能开发吗?

准备好 加速您的人工智能开发吗?