모델

제품

가격

문서

블로그

에 대하여

연락하다

🎉 Hy3-preview 는 SiliconFlow에서 가능합니다. 지금 시도해 보세요.

🎉 Hy3-preview 는 SiliconFlow에서 가능합니다. 지금 시도해 보세요.

모델

Qwen3-235B-A22B-Instruct-2507

Qwen3-235B-A22B-Instruct-2507

Qwen/Qwen3-235B-A22B-Instruct-2507

API 참조

정보에 대해서Qwen3-235B-A22B-Instruct-2507

Qwen3-235B-A22B-Instruct-2507은 Alibaba Cloud의 Qwen 팀이 개발한 Qwen3 시리즈의 대표 Mixture-of-Experts (MoE) 대형 언어 Model입니다. 이 Model은 총 2,350억 개의 매개변수를 가지고 있으며, 매 포워드 패스당 220억 개가 활성화됩니다. 이는 Qwen3-235B-A22B 비사고 모드의 업데이트된 버전으로 출시되었으며, 지시 사항 따르기, 논리적 추론, Text 이해, 수학, 과학, 코딩 및 도구 사용과 같은 일반적인 기능 향상이 특징입니다. 또한, 다중 언어에서의 긴 꼬리 지식 범위에서 상당한 이점을 제공하며, 주관적이고 개방적인 작업에서 사용자 선호도와 더욱 잘 맞춰져 더욱 도움이 되는 응답과 고품질 Text 생성이 가능하게 합니다. 특히, 광범위한 256K (262,144 tokens) 컨텍스트 창을 본래 지원하여 장기 컨텍스트 이해의 기능을 향상시킵니다. 이 버전은 비사고 모드만을 독점적으로 지원하며, <think> 블록을 생성하지 않으며, 직접적인 Q&A 및 지식 검색과 같은 작업에 대한 더 효율적이고 정확한 응답을 제공하는 것을 목표로 합니다.

사용 가능한 Serverless

쿼리를 즉시 실행하고 사용한 만큼만 지불하세요.

1M 토큰당 (Input/Output)

$

0.09

/ M Tokens

1M 토큰당 (Input/Output)

$

0.6

/ M Tokens

Playground

API 사용

벤치마크

사용 사례

Loading...

메타데이터

생성하다

2025. 7. 23.

라이센스

APACHE-2.0

공급자

Qwen

허깅페이스

Qwen3-235B-A22B-Instruct-2507

사양

주

Available

건축

Mixture of Experts

교정된

네

전문가의 혼합

네

총 매개변수

235B

활성화된 매개변수

22B

추론

아니요

Precision

FP8

콘텍스트 길이

262K

Max Tokens

262K

지원됨 기능

Serverless

지원됨

Serverless LoRA

지원하지 않음

Fine-tuning

지원하지 않음

Embedding

지원하지 않음

Rerankers

지원하지 않음

지원 Image Input

지원하지 않음

JSON Mode

지원됨

구조화된 Outputs

지원하지 않음

도구

지원됨

Fim Completion

지원하지 않음

Chat Prefix Completion

지원됨

다른 모델과 비교

이 Model이 다른 것들과 어떻게 비교되는지 보세요.

Qwen

chat

Qwen3-VL-32B-Instruct

출시일: 2025. 10. 21.

Total Context:

262K

Max output:

262K

Input:

$

0.2

/ M Tokens

Output:

$

0.6

/ M Tokens

Qwen

chat

Qwen3-VL-32B-Thinking

출시일: 2025. 10. 21.

Total Context:

262K

Max output:

262K

Input:

$

0.2

/ M Tokens

Output:

$

1.5

/ M Tokens

Qwen

chat

Qwen3-VL-8B-Instruct

출시일: 2025. 10. 15.

Total Context:

262K

Max output:

262K

Input:

$

0.18

/ M Tokens

Output:

$

0.68

/ M Tokens

Qwen

chat

Qwen3-VL-8B-Thinking

출시일: 2025. 10. 15.

Total Context:

262K

Max output:

262K

Input:

$

0.18

/ M Tokens

Output:

$

2

/ M Tokens

Qwen

chat

Qwen3-VL-235B-A22B-Instruct

출시일: 2025. 10. 4.

Total Context:

262K

Max output:

262K

Input:

$

0.3

/ M Tokens

Output:

$

1.5

/ M Tokens

Qwen

chat

Qwen3-VL-235B-A22B-Thinking

출시일: 2025. 10. 4.

Total Context:

262K

Max output:

262K

Input:

$

0.45

/ M Tokens

Output:

$

3.5

/ M Tokens

Qwen

chat

Qwen3-VL-30B-A3B-Instruct

출시일: 2025. 10. 5.

Total Context:

262K

Max output:

262K

Input:

$

0.29

/ M Tokens

Output:

$

1

/ M Tokens

Qwen

chat

Qwen3-VL-30B-A3B-Thinking

출시일: 2025. 10. 11.

Total Context:

262K

Max output:

262K

Input:

$

0.29

/ M Tokens

Output:

$

1

/ M Tokens

Qwen

image-to-video

Wan2.2-I2V-A14B

출시일: 2025. 8. 13.

$

0.29

/ Video

AI 개발을 가속화할 준비가 되셨나요?

AI 개발을 가속화할 준비가 되셨나요?

AI 개발을 가속화할 준비가 되셨나요?

페이지

모델

제품

© 2025 SiliconFlow

·

개인정보 보호

페이지

모델

제품

© 2025 SiliconFlow

·

개인정보 보호

페이지

모델

제품

© 2025 SiliconFlow

·

개인정보 보호