DeepSeek-R1-0120

DeepSeek-R1-0120

정보에 대해서DeepSeek-R1-0120

DeepSeek-R1은 반복성과 가독성 문제를 해결하는 강화 학습(RL) 기반의 추론 Model입니다. RL 이전에는 DeepSeek-R1이 추론 성능을 더욱 최적화하기 위해 콜드 스타트 데이터를 통합했습니다. 수학, 코드 및 추론 작업에서 OpenAI-o1과 비교할 만한 성능을 달성하며, 신중하게 설계된 훈련 방법을 통해 전체적인 효율성을 향상시켰습니다.

메타데이터

생성하다

라이센스

공급자

DeepSeek

허깅페이스

사양

Deprecated

건축

교정된

아니요

전문가의 혼합

아니요

총 매개변수

671B

활성화된 매개변수

추론

아니요

Precision

FP8

콘텍스트 길이

66K

Max Tokens

AI 개발을 가속화할 준비가 되셨나요?

AI 개발을 가속화할 준비가 되셨나요?

AI 개발을 가속화할 준비가 되셨나요?