정보에 대해서deepseek-vl2
DeepSeek-VL2는 4.5B 활성 매개변수만으로 우수한 성능을 달성하기 위해 희소 활성 MoE 구조를 사용하여 DeepSeekMoE-27B를 기반으로 개발된 혼합 전문가(MoE) Vision-언어 Model입니다. 이 Model은 시각적 질문 응답, 광학 문자 인식, 문서/표/차트 이해 및 시각적 정지 등의 다양한 작업에서 뛰어난 성능을 발휘합니다. 기존의 오픈 소스 밀집 Model 및 MoE 기반 Model과 비교하여 동일하거나 더 적은 활성 매개변수를 사용하여 경쟁력 있는 또는 최첨단 성능을 보여줍니다.
사용 가능한 Serverless
쿼리를 즉시 실행하고 사용한 만큼만 지불하세요.
$
0.15
/
$
0.15
1M 토큰당 (Input/Output)
메타데이터
사양
주
Available
건축
교정된
아니요
전문가의 혼합
네
총 매개변수
27B
활성화된 매개변수
4.5B
추론
아니요
Precision
FP8
콘텍스트 길이
4K
Max Tokens
4K
지원됨 기능
Serverless
지원됨
Serverless LoRA
지원하지 않음
Fine-tuning
지원하지 않음
Embedding
지원하지 않음
Rerankers
지원하지 않음
지원 Image Input
지원됨
JSON Mode
지원됨
구조화된 Outputs
지원하지 않음
도구
지원하지 않음
Fim Completion
지원하지 않음
Chat Prefix Completion
지원됨
다른 모델과 비교
이 Model이 다른 것들과 어떻게 비교되는지 보세요.
DeepSeek
chat
DeepSeek-V3.2
출시일: 2025. 12. 4.
Total Context:
164K
Max output:
164K
Input:
$
0.27
/ M Tokens
Output:
$
0.42
/ M Tokens
DeepSeek
chat
DeepSeek-V3.2-Exp
출시일: 2025. 10. 10.
Total Context:
164K
Max output:
164K
Input:
$
0.27
/ M Tokens
Output:
$
0.41
/ M Tokens
DeepSeek
chat
DeepSeek-V3.1-Terminus
출시일: 2025. 9. 29.
Total Context:
164K
Max output:
164K
Input:
$
0.27
/ M Tokens
Output:
$
1.0
/ M Tokens
DeepSeek
chat
DeepSeek-V3.1
출시일: 2025. 8. 25.
Total Context:
164K
Max output:
164K
Input:
$
0.27
/ M Tokens
Output:
$
1.0
/ M Tokens
DeepSeek
chat
DeepSeek-V3
출시일: 2024. 12. 26.
Total Context:
164K
Max output:
164K
Input:
$
0.25
/ M Tokens
Output:
$
1.0
/ M Tokens
DeepSeek
chat
DeepSeek-R1
출시일: 2025. 5. 28.
Total Context:
164K
Max output:
164K
Input:
$
0.5
/ M Tokens
Output:
$
2.18
/ M Tokens
DeepSeek
chat
DeepSeek-R1-Distill-Qwen-32B
출시일: 2025. 1. 20.
Total Context:
131K
Max output:
131K
Input:
$
0.18
/ M Tokens
Output:
$
0.18
/ M Tokens
DeepSeek
chat
DeepSeek-R1-Distill-Qwen-14B
출시일: 2025. 1. 20.
Total Context:
131K
Max output:
131K
Input:
$
0.1
/ M Tokens
Output:
$
0.1
/ M Tokens
DeepSeek
chat
DeepSeek-R1-Distill-Qwen-7B
출시일: 2025. 1. 20.
Total Context:
33K
Max output:
16K
Input:
$
0.05
/ M Tokens
Output:
$
0.05
/ M Tokens
