GLM-Z1-Rumination-32B-0414

GLM-Z1-Rumination-32B-0414

關於GLM-Z1-Rumination-32B-0414

GLM-Z1-Rumination-32B-0414 是一個具有反思能力的深度推理模型(以 OpenAI 的深度研究作為基準)。與典型的深度思考模型不同,反思模型採用更長時間的深度思考來解決更多開放性和複雜的問題(例如,撰寫兩個城市的 AI 發展比較分析及其未來發展計劃)。反思模型在其深度思考過程中整合了搜索工具以處理複雜任務,並通過利用多重基於規則的獎勵來指導和延伸端到端強化學習的訓練。Z1-Rumination 在研究型寫作和複雜檢索任務中顯示出顯著的改善。模型支持完整的研究週期,包括“獨立提出問題—搜索資訊—構建分析—完成任務”,並默認包含如搜索、點擊、打開和完成等功能呼叫,使其能夠更好地應對需要外部資訊的複雜問題。

元數據

創建於

許可證

MIT

供應商

Z.ai

規格

狀態

Deprecated

架構

經過校準的

專家並行

總參數

32B

啟用的參數

推理

精度

FP8

上下文長度

33K

最大輸出長度

準備好 加速您的人工智能開發了嗎?

準備好 加速您的人工智能開發了嗎?

準備好 加速您的人工智能開發了嗎?