Qwen3-Next-80B-A3B-Thinking

Qwen3-Next-80B-A3B-Thinking

Qwen/Qwen3-Next-80B-A3B-Thinking

정보에 대해서Qwen3-Next-80B-A3B-Thinking

Qwen3-Next-80B-A3B-Thinking은 Alibaba의 Qwen 팀에서 복잡한 추론 작업을 위해 특별히 설계된 차세대 기초 Model입니다. 이는 Gated DeltaNet과 Gated Attention을 결합한 Hybrid Attention 메커니즘과 고스파시티 혼합 전문가(MoE) 구조를 사용하여 궁극적인 훈련 및 Inference 효율성을 달성합니다. 800억 개의 매개변수를 가진 Sparse Model로, Inference 도중 약 30억 개의 매개변수만 활성화하여 계산 비용을 크게 줄이고, 32K token을 초과하는 장기 컨텍스트 작업에서 Qwen3-32B 모델보다 10배 이상의 처리량을 제공합니다. 이 'Thinking' 버전은 수학적 증명, 코드 합성, 논리적 분석, 계획과 같은 까다로운 다단계 문제에 최적화되어 있으며, 기본적으로 구조화된 'thinking' 트레이스를 Output 합니다. 성능 면에서, 더 높은 비용의 모델인 Qwen3-32B-Thinking을 능가했으며 여러 벤치마크에서 Gemini-2.5-Flash-Thinking을 능가했습니다.

사용 가능한 Serverless

쿼리를 즉시 실행하고 사용한 만큼만 지불하세요.

$

0.14

/

$

0.57

1M 토큰당 (Input/Output)

메타데이터

생성하다

2025. 9. 25.

라이센스

APACHE-2.0

공급자

Qwen

사양

Available

건축

교정된

아니요

전문가의 혼합

총 매개변수

80B

활성화된 매개변수

3B

추론

아니요

Precision

FP8

콘텍스트 길이

262K

Max Tokens

262K

지원됨 기능

Serverless

지원됨

Serverless LoRA

지원하지 않음

Fine-tuning

지원하지 않음

Embedding

지원하지 않음

Rerankers

지원하지 않음

지원 Image Input

지원하지 않음

JSON Mode

지원하지 않음

구조화된 Outputs

지원하지 않음

도구

지원됨

Fim Completion

지원하지 않음

Chat Prefix Completion

지원됨

AI 개발을 가속화할 준비가 되셨나요?

AI 개발을 가속화할 준비가 되셨나요?

AI 개발을 가속화할 준비가 되셨나요?

Korean

© 2025 SiliconFlow

Korean

© 2025 SiliconFlow

Korean

© 2025 SiliconFlow