step3

step3

stepfun-ai/step3

정보에 대해서step3

Step3는 최첨단 멀티모달 추론 Model이며, StepFun에서 개발했습니다. 321B의 총 매개변수와 38B의 활성 매개변수로 구성된 Mixture-of-Experts (MoE) 아키텍처에 기반하고 있습니다. 이 Model은 비전-언어 추론에서 최고 수준의 성능을 제공하면서 디코딩 비용을 최소화하도록 엔드 투 엔드로 설계되었습니다. Multi-Matrix Factorization Attention (MFA)와 Attention-FFN Disaggregation (AFD)의 공동 설계를 통해 Step3는 주력 가속기와 저급 가속기 모두에서 뛰어난 효율성을 유지합니다. 사전 학습 동안 Step3는 20T 이상의 Text tokens와 4T 이미지-Text 혼합 tokens를 처리했으며, 10개 이상의 언어를 걸쳐 있습니다. 이 Model은 수학, 코드, 멀티모달리티를 포함한 다양한 벤치마크에서 오픈 소스 모델의 최신 성능을 달성했습니다.

사용 가능한 Serverless

쿼리를 즉시 실행하고 사용한 만큼만 지불하세요.

$

0.57

/

$

1.42

1M 토큰당 (Input/Output)

메타데이터

생성하다

2025. 8. 6.

라이센스

APACHE LICENSE (VERSION 2.0)

공급자

StepFun

허깅페이스

사양

Available

건축

교정된

아니요

전문가의 혼합

총 매개변수

321B

활성화된 매개변수

38B

추론

아니요

Precision

FP8

콘텍스트 길이

66K

Max Tokens

66K

지원됨 기능

Serverless

지원됨

Serverless LoRA

지원하지 않음

Fine-tuning

지원하지 않음

Embedding

지원하지 않음

Rerankers

지원하지 않음

지원 Image Input

지원됨

JSON Mode

지원됨

구조화된 Outputs

지원하지 않음

도구

지원됨

Fim Completion

지원하지 않음

Chat Prefix Completion

지원하지 않음

다른 모델과 비교

이 Model이 다른 것들과 어떻게 비교되는지 보세요.

AI 개발을 가속화할 준비가 되셨나요?

AI 개발을 가속화할 준비가 되셨나요?

AI 개발을 가속화할 준비가 되셨나요?

Korean

© 2025 SiliconFlow

Korean

© 2025 SiliconFlow

Korean

© 2025 SiliconFlow