DeepSeek-R1-0120

DeepSeek-R1-0120

Tentang DeepSeek-R1-0120

DeepSeek-R1 adalah model pemikiran yang didukung oleh reinforcement learning (RL) yang mengatasi masalah pengulangan dan keterbacaan. Sebelum RL, DeepSeek-R1 menggabungkan data start dingin untuk lebih mengoptimalkan kinerja pemikirannya. Ini mencapai kinerja yang sebanding dengan OpenAI-o1 dalam tugas matematika, kode, dan pemikiran, dan melalui metode pelatihan yang dirancang dengan cermat, ini telah meningkatkan efektivitas keseluruhan.

Metadata

Buat di

Lisensi

Penyedia

DeepSeek

HuggingFace

Spesifikasi

Negara

Deprecated

Arsitektur

Terkalibrasi

Tidak

Campuran Ahli

Tidak

Total Parameter

671B

Parameter yang Diaktifkan

Penalaran

Tidak

Precision

FP8

Text panjang konteks

66K

Max Tokens

Siap untuk mempercepat pengembangan AI Anda?

Siap untuk mempercepat pengembangan AI Anda?

Siap untuk mempercepat pengembangan AI Anda?