Qwen3-Next-80B-A3B-Instruct

Qwen3-Next-80B-A3B-Instruct

Qwen/Qwen3-Next-80B-A3B-Instruct

정보에 대해서Qwen3-Next-80B-A3B-Instruct

Qwen3-Next-80B-A3B-Instruct는 Alibaba의 Qwen 팀이 출시한 차세대 기초 Model입니다. 이는 궁극의 훈련 및 Inference 효율성을 위해 설계된 새로운 Qwen3-Next 아키텍처를 기반으로 구축되었습니다. 이 Model은 하이브리드 어텐션 메커니즘(게이트 델타넷과 게이트 어텐션), 고희소 혼합 전문가(MoE) 구조 및 다양한 안정성 최적화와 같은 혁신적인 기능을 통합하고 있습니다. 800억 개의 매개변수를 가진 희소 Model로서, Inference 과정에서 token당 약 30억 개의 매개변수만 활성화되어 계산 비용을 크게 절감하고 32K tokens를 초과하는 장문 작업에서 Qwen3-32B Model보다 10배 이상의 처리량을 제공합니다. 이는 범용 작업에 최적화된 인스트럭션 튜닝 버전이며 '사고' 모드를 지원하지 않습니다. 성능 측면에서 일부 벤치마크에서 Qwen의 플래그십 Model인 Qwen3-235B와 비교할 수 있으며, 초장문 시나리오에서 상당한 장점을 보여줍니다.

사용 가능한 Serverless

쿼리를 즉시 실행하고 사용한 만큼만 지불하세요.

$

0.14

/

$

1.4

1M 토큰당 (Input/Output)

메타데이터

생성하다

2025. 9. 18.

라이센스

APACHE-2.0

공급자

Qwen

사양

Available

건축

교정된

아니요

전문가의 혼합

총 매개변수

80B

활성화된 매개변수

3B

추론

아니요

Precision

FP8

콘텍스트 길이

262K

Max Tokens

262K

지원됨 기능

Serverless

지원됨

Serverless LoRA

지원하지 않음

Fine-tuning

지원하지 않음

Embedding

지원하지 않음

Rerankers

지원하지 않음

지원 Image Input

지원하지 않음

JSON Mode

지원됨

구조화된 Outputs

지원하지 않음

도구

지원됨

Fim Completion

지원하지 않음

Chat Prefix Completion

지원됨

AI 개발을 가속화할 준비가 되셨나요?

AI 개발을 가속화할 준비가 되셨나요?

AI 개발을 가속화할 준비가 되셨나요?

Korean

© 2025 SiliconFlow

Korean

© 2025 SiliconFlow

Korean

© 2025 SiliconFlow