모든 GPT 20% 할인 🎉 DeepSeek 30% 할인자세히 보기

GLM-5.2는 Z.ai의 국제 플랫폼(api.z.ai)의 플래그십 추론 모델로, 오픈 웨이트 MoE 아키텍처와 1M token context window를 갖추고 있습니다. 내장 사고 기능(reasoning_content), 프롬프트 캐싱, 도구 호출, 웹 검색을 지원하며, 코딩과 장기 에이전틱 실행에서 강력한 성능을 발휘합니다. OpenAI-compatible 및 Anthropic 프로토콜로 이용 가능합니다.

컨텍스트 윈도우
1M
최대 출력 토큰
128K
출시일
2026-06-16
기능
Function Calling추론프롬프트 캐싱웹 검색
제공업체
AliyunAlibaba CloudVolcengineZ.ai
지원 프로토콜
openaianthropic

Providers

Alibaba Cloudprovider.type: "alicloud"
입력 토큰
$1.4/M
출력 토큰
$4.4/M
캐시 읽기
$0.26/M
웹 검색
$0.01/R
Protocols
openai/v1/chat/completions
anthropic
Aliyunprovider.type: "aliyun"
입력 토큰
$1.4/M
출력 토큰
$4.4/M
캐시 읽기
$0.26/M
웹 검색
$0.01/R
Protocols
openai/v1/chat/completions
anthropic
Volcengineprovider.type: "volcengine"
입력 토큰
$1.4/M
출력 토큰
$4.4/M
캐시 읽기
$0.26/M
웹 검색
$0.01/R
Protocols
openai/v1/chat/completions/v1/responses
anthropic
Z.aiprovider.type: "zai"
입력 토큰
$1.4/M
출력 토큰
$4.4/M
캐시 읽기
$0.26/M
웹 검색
$0.01/R
Protocols
openai/v1/chat/completions
anthropic

코드 예제

from openai import OpenAI
client = OpenAI(
base_url="https://api.ofox.run/v1",
api_key="YOUR_OFOX_API_KEY",
)
response = client.chat.completions.create(
model="z-ai/glm-5.2",
messages=[
{"role": "user", "content": "Hello!"}
],
)
print(response.choices[0].message.content)

가동 시간 및 상태

벤치마크

LMArena ↗평가 항목: glm-5.2 (max)

Z.ai: GLM-5.2은(는) LMArena 텍스트 리더보드(스타일 컨트롤) 종합 카테고리에서 1464점을 기록했으며, 14,228건의 인간 선호 투표를 기반으로 374개 모델 중 35위입니다(업데이트: 2026-07-12).

LMArena의 glm-5.2 (max) 벤치마크 점수
카테고리Arena 점수95% 신뢰구간순위투표 수
종합14641458–1471374개 중 35위14,228
고난도 프롬프트14871480–1494374개 중 32위9,331
코딩15111501–1521369개 중 33위3,968
수학14771455–1499362개 중 22위708
창작14431431–1455372개 중 38위2,561
지시 이행14611452–1470374개 중 29위4,852
중국어15041481–1526344개 중 29위728

출처: LMArena · CC BY 4.0 · 업데이트 2026-07-12 · 평가 방법 ↗ · 순위는 LMArena 텍스트 리더보드(스타일 컨트롤)의 각 카테고리 내 비교이며, 점수는 제3자의 인간 선호 평가로 OFOX 공식 평가가 아닙니다.

자주 묻는 질문

Z.ai: GLM-5.2은(는) Ofox.ai에서 입력 $1.4/M/백만 토큰, 출력 $4.4/M/백만 토큰입니다. 종량제, 월정액 없음.