GLM-5

GLM-5

zai-org/GLM-5

정보에 대해서GLM-5

GLM-5 is a next-generation open-source model for complex systems engineering and long-horizon agentic tasks, scaled to ~744B sparse parameters (~40B active) with ~28.5T pretraining tokens. It integrates DeepSeek Sparse Attention (DSA) to retain long-context capacity while reducing inference cost, and leverages the “slime” asynchronous RL stack to deliver strong performance in reasoning, coding, and agentic benchmarks.

사용 가능한 Serverless

쿼리를 즉시 실행하고 사용한 만큼만 지불하세요.

$

1.0

/

$

3.2

1M 토큰당 (Input/Output)

메타데이터

생성하다

2026. 2. 12.

라이센스

MIT

공급자

Z.ai

허깅페이스

사양

Available

건축

Mixture of Experts (MoE) with DeepSeek Sparse Attention (DSA) and asynchronous RL stack

교정된

아니요

전문가의 혼합

총 매개변수

750B

활성화된 매개변수

40B

추론

아니요

Precision

FP8

콘텍스트 길이

205K

Max Tokens

131K

지원됨 기능

Serverless

지원됨

Serverless LoRA

지원하지 않음

Fine-tuning

지원하지 않음

Embedding

지원하지 않음

Rerankers

지원하지 않음

지원 Image Input

지원하지 않음

JSON Mode

지원하지 않음

구조화된 Outputs

지원하지 않음

도구

지원됨

Fim Completion

지원하지 않음

Chat Prefix Completion

지원하지 않음

AI 개발을 가속화할 준비가 되셨나요?

AI 개발을 가속화할 준비가 되셨나요?

AI 개발을 가속화할 준비가 되셨나요?

Korean

© 2025 SiliconFlow

Korean

© 2025 SiliconFlow

Korean

© 2025 SiliconFlow