DeepSeek-R1-0120

DeepSeek-R1-0120

約DeepSeek-R1-0120

DeepSeek-R1は、反復と可読性の問題に対処する強化学習(RL)によって強化された推論Modelです。RLの前に、DeepSeek-R1は冷スタートデータを取り入れ、その推論パフォーマンスをさらに最適化しました。それは、数学、コード、推論タスク全般でOpenAI-o1と同等のパフォーマンスを達成し、慎重に設計されたトレーニング方法を通じて、全体的な効果を向上させました。

メタデータ

作成する

ライセンス

プロバイダー

DeepSeek

ハギングフェイス

仕様

Deprecated

建築

キャリブレートされた

いいえ

専門家の混合

いいえ

合計パラメータ

671B

アクティブ化されたパラメータ

推論

いいえ

Precision

FP8

コンテキスト長

66K

Max Tokens

AI開発を 加速する準備はできていますか?

AI開発を 加速する準備はできていますか?

AI開発を 加速する準備はできていますか?