約GLM-Z1-Rumination-32B-0414
GLM-Z1-Rumination-32B-0414は、OpenAIのDeep Researchと比較した反響能力を備えた深層推論のモデルです。典型的な深層思考モデルとは異なり、反響モデルはより長い期間の深い思考を採用して、よりオープンエンドで複雑な問題を解決します(例: 二つの都市におけるAI開発の比較分析とその将来の開発計画の作成)。反響モデルは、複雑なタスクを処理するための検索ツールを統合し、エンドツーエンドの強化学習をガイドし拡張するための複数のルールベースの報酬を利用して訓練されています。Z1-Ruminationは、研究スタイルのライティングと複雑な検索タスクにおいて著しい改善を示しています。このモデルは、「独自で質問を立てる—情報を検索する—分析を構築する—タスクを完了する」という完全な研究サイクルをサポートしており、デフォルトで検索、クリック、開く、終了といった機能呼び出しを含んでいるため、外部情報を必要とする複雑な問題をより適切に処理できます
メタデータ
仕様
州
Deprecated
建築
キャリブレートされた
いいえ
専門家の混合
いいえ
合計パラメータ
32B
アクティブ化されたパラメータ
推論
いいえ
Precision
FP8
コンテキスト長
33K
Max Tokens
他のModelsと比較
他のモデルに対してこのModelがどのように比較されるかを見てください。

Z.ai
GLM-4.7
Total Context:
205K
Max output:
205K
Input:
$
0.42
/ M Tokens
Output:
$
2.2
/ M Tokens

Z.ai
chat
GLM-4.6V
Total Context:
131K
Max output:
131K
Input:
$
0.3
/ M Tokens
Output:
$
0.9
/ M Tokens

Z.ai
chat
GLM-4.6
Total Context:
205K
Max output:
205K
Input:
$
0.39
/ M Tokens
Output:
$
1.9
/ M Tokens

Z.ai
chat
GLM-4.5-Air
Total Context:
131K
Max output:
131K
Input:
$
0.14
/ M Tokens
Output:
$
0.86
/ M Tokens

Z.ai
chat
GLM-4.5V
Total Context:
66K
Max output:
66K
Input:
$
0.14
/ M Tokens
Output:
$
0.86
/ M Tokens

Z.ai
chat
GLM-4.1V-9B-Thinking
Total Context:
66K
Max output:
66K
Input:
$
0.035
/ M Tokens
Output:
$
0.14
/ M Tokens

Z.ai
chat
GLM-Z1-32B-0414
Total Context:
131K
Max output:
131K
Input:
$
0.14
/ M Tokens
Output:
$
0.57
/ M Tokens

Z.ai
chat
GLM-4-32B-0414
Total Context:
33K
Max output:
33K
Input:
$
0.27
/ M Tokens
Output:
$
0.27
/ M Tokens

Z.ai
chat
GLM-Z1-9B-0414
Total Context:
131K
Max output:
131K
Input:
$
0.086
/ M Tokens
Output:
$
0.086
/ M Tokens
