모델 비교

Qwen2.5-VL-72B-Instruct

step3

2026. 2. 28.

가격

Input

$

0.59

/ M Tokens

$

0.57

/ M Tokens

Output

$

0.59

/ M Tokens

$

1.42

/ M Tokens

메타데이터

생성하다

2025. 1. 27.

2025. 7. 28.

라이센스

-

APACHE LICENSE (VERSION 2.0)

공급자

Qwen

StepFun

사양

Available

Deprecated

건축

Vision-Language Model (VLM) with a Streamlined and Efficient Vision Encoder (ViT with window attention, SwiGLU, RMSNorm) aligned with the Qwen2.5 LLM structure. Features include Dynamic Resolution and Frame Rate Training for video understanding, mRoPE for temporal sequence and speed, and YaRN for long text context length extrapolation.

Mixture-of-Experts (MoE) architecture with Multi-Matrix Factorization Attention (MFA) and Attention-FFN Disaggregation (AFD)

교정된

아니요

아니요

전문가의 혼합

아니요

총 매개변수

72B

321B

활성화된 매개변수

72B

38B

추론

아니요

아니요

Precision

FP8

FP8

콘텍스트 길이

131K

66K

Max Tokens

4K

66K

지원됨 기능

Serverless

지원됨

지원됨

Serverless LoRA

지원하지 않음

지원하지 않음

Fine-tuning

지원하지 않음

지원하지 않음

Embedding

지원하지 않음

지원하지 않음

Rerankers

지원하지 않음

지원하지 않음

지원 Image Input

지원하지 않음

지원하지 않음

JSON Mode

지원하지 않음

지원됨

구조화된 Outputs

지원하지 않음

지원하지 않음

도구

지원하지 않음

지원됨

Fim Completion

지원하지 않음

지원하지 않음

Chat Prefix Completion

지원됨

지원하지 않음

AI 개발을 가속화할 준비가 되셨나요?

AI 개발을 가속화할 준비가 되셨나요?

AI 개발을 가속화할 준비가 되셨나요?

Korean

© 2025 SiliconFlow

Korean

© 2025 SiliconFlow

Korean

© 2025 SiliconFlow