모델

제품

가격

문서

블로그

에 대하여

연락하다

🎉 gemma-4-12B-it 는 SiliconFlow에서 가능합니다. 지금 시도해 보세요.

🎉 gemma-4-12B-it 는 SiliconFlow에서 가능합니다. 지금 시도해 보세요.

모델

Hunyuan-A13B-Instruct

Hunyuan-A13B-Instruct

tencent/Hunyuan-A13B-Instruct

API 참조

정보에 대해서Hunyuan-A13B-Instruct

Hunyuan-A13B-Instruct는 80B 매개변수 중 단 13B만 활성화하면서도 주류 벤치마크에서 더 큰 LLM과 맞먹습니다. 이는 하이브리드 추론을 제공합니다: 저지연 “빠른” 모드 또는 고정밀 “느린” 모드, 호출당 전환 가능합니다. 네이티브 256 K-token 컨텍스트는 책 길이의 문서를 열화 없이 소화할 수 있게 해줍니다. 에이전트 기술은 BFCL-v3, τ-Bench 및 C3-Bench 리더십에 맞춰 조정되어 있으며, 이를 훌륭한 자율형 어시스턴트 백본으로 만듭니다. 그룹화된 쿼리 주의력 및 다형식 양자화는 메모리 부담이 적고 GPU 효율적인 Inference를 위해 실사용 배포 시 지원하며, 내장된 다국어 지원과 견고한 안전 정렬로 기업급 애플리케이션에 적합합니다.

사용 가능한 Serverless

쿼리를 즉시 실행하고 사용한 만큼만 지불하세요.

1M 토큰당 (Input/Output)

$

0.14

/ M Tokens

1M 토큰당 (Input/Output)

$

0.57

/ M Tokens

Playground

API 사용

벤치마크

사용 사례

Loading...

메타데이터

생성하다

2025. 6. 30.

라이센스

-

공급자

Tencent

허깅페이스

Hunyuan-A13B-Instruct

사양

주

Available

건축

Mixture of Experts

교정된

네

전문가의 혼합

네

총 매개변수

80B

활성화된 매개변수

13B

추론

아니요

Precision

FP8

콘텍스트 길이

131K

Max Tokens

131K

지원됨 기능

Serverless

지원됨

Serverless LoRA

지원하지 않음

Fine-tuning

지원하지 않음

Embedding

지원하지 않음

Rerankers

지원하지 않음

지원 Image Input

지원하지 않음

JSON Mode

지원됨

구조화된 Outputs

지원하지 않음

도구

지원하지 않음

Fim Completion

지원하지 않음

Chat Prefix Completion

지원하지 않음

다른 모델과 비교

이 Model이 다른 것들과 어떻게 비교되는지 보세요.

Tencent

chat

Hunyuan-MT-7B

출시일: 2025. 9. 18.

Total Context:

33K

Max output:

33K

Input:

$

0.0

/ M Tokens

Output:

$

0.0

/ M Tokens

Tencent

chat

Hunyuan-A13B-Instruct

출시일: 2025. 6. 30.

Total Context:

131K

Max output:

131K

Input:

$

0.14

/ M Tokens

Output:

$

0.57

/ M Tokens

Tencent

chat

Hy3-preview

출시일: 2026. 4. 7.

Total Context:

262K

Max output:

262K

Input:

$

0.066

/ M Tokens

Output:

$

0.26

/ M Tokens

AI 개발을 가속화할 준비가 되셨나요?

AI 개발을 가속화할 준비가 되셨나요?

AI 개발을 가속화할 준비가 되셨나요?

페이지

모델

제품

© 2025 SiliconFlow

·

개인정보 보호

페이지

모델

제품

© 2025 SiliconFlow

·

개인정보 보호

페이지

모델

제품

© 2025 SiliconFlow

·

개인정보 보호