Z.ai (GLM) · 모델

GLM-5.2

오픈출시 2026년 6월 16일zai-org/GLM-5.2Hugging Face ↗
종합 레이팅1109 · 53위가중 비교 23
컨텍스트 창—
가격 (입력 / 출력, 1M 토큰)오픈 웨이트
파라미터753BGlmMoeDsaForCausalLM
라이선스mit
최근 30일 다운로드670.8K좋아요 5.2K · 7일 -60.3K
벤치 점수40개코딩·에이전트·추론·지식·과학·보안

AI AI 해설

2026년 10월 9일 생성

에이전트 분야가 상대적으로 돋보이는 MIT 오픈 웨이트 모델

종합 평가

종합 레이팅은 1023(32위), 가중 비교는 15다. 비슷한 레이팅의 모델은 Qwen3.5-397B-A17B 1026(30위), Qwen3.5-122B-A10B 1025(31위), Kimi-K2.5 1017(33위), Solar-Open2-250B 1011(34위)다.

분야별 특성

에이전트 929(16위), 추론·지식 1039(24위), 코딩 963(41위), 과학·보안 884다. 멀티모달은 자료 없음이다. 레이팅은 같은 벤치 비교를 바탕으로 한 상대 지표다.

주요 벤치 결과

HF 리더보드에서 GPQA Diamond 91.2%(8/70), Humanity's Last Exam 40.5%(7/48), Terminal-Bench 2.1 82.7%(12/28), DeepSWE 46.2%(17/21)다. Public 731의 SWE-bench Pro는 62.1%(17/63)다. 프로필이 다른 점수끼리는 직접 비교할 수 없다.

도입 전 확인사항

오픈 웨이트이며 라이선스는 mit다. 컨텍스트, 최대 출력, 입력·출력 가격은 자료 없음이다. 일부 LLM Stats 집계와 HF 리더보드 결과는 미검증이며, Z.ai 공개 평가는 해당 출처와 하네스 범위에서 해석해야 한다.

수집된 벤치·가격·출시 숫자만 입력으로 받아 LLM이 작성했고, 입력에 없는 숫자가 나오면 폐기합니다. 사용 결정은 원문 출처와 직접 평가로 확인하세요.

분야레이팅분야 순위비교 수
코딩9956010.4
에이전트932493.8
추론·지식1134367.6
멀티모달———
과학·보안885—1.2
차트를 불러오는 중입니다…

분야 레이팅은 그 분야 벤치에서의 비교만으로 계산합니다. 회색 선은 종합 1위 모델입니다.

벤치마크 점수

40개 · 프로필별 순위

코딩

벤치프로필점수순위백분위출처
SWE-bench ProPublic 73162.1%17 / 6374확인됨 ↗
SWE-bench ProLLM Stats 집계62.1%17 / 5570자기보고 ↗
Terminal-Bench 2.1LLM Stats 집계82.7%21 / 4354자기보고 ↗
DeepSWE 1.1LLM Stats 집계44%33 / 3916인용 ↗
Terminal-Bench 2.1HF 리더보드82.7%12 / 2859확인됨 ↗
FrontierCode 1.1LLM Stats 집계24.5%19 / 2214인용 ↗
DeepSWEHF 리더보드46.2%17 / 2120확인됨 ↗
IMO-AnswerBenchLLM Stats 집계91%2 / 1894자기보고 ↗
FrontierSWELLM Stats 집계74%6 / 1769인용 ↗
DeepSWELLM Stats 집계46.2%10 / 1325자기보고 ↗
Long-Horizon Terminal BenchHF 리더보드1.07 / 919인용 ↗
PostTrainBenchLLM Stats 집계34.3%5 / 733자기보고 ↗
Terminal-Bench 3.0Z.ai 공개 평가4.6%6 / 60확인됨 ↗
PostTrainBenchZ.ai 공개 평가31.7%6 / 60확인됨 ↗
SWE-Marathon 1.1Z.ai 공개 평가19.4%6 / 60확인됨 ↗
SWE-MarathonLLM Stats 집계13%5 / 50자기보고 ↗
FrontierSWEZ.ai 공개 평가67.5%3 / 433확인됨 ↗
RedlineBenchHF 리더보드45.7%2 / 20확인됨 ↗

에이전트

벤치프로필점수순위백분위출처
ToolathlonLLM Stats 집계48.2%27 / 3830자기보고 ↗
MCP Atlas · PublicLLM Stats 집계76.8%11 / 3671자기보고 ↗
WildClawBenchHF 리더보드54.2%4 / 2286인용 ↗
GDPval-AA v2Z.ai 공개 평가1,5087 / 70확인됨 ↗
Agents' Last Exam · CLIZ.ai 공개 평가23.8%7 / 78확인됨 ↗
AutomationBench 1.0.6Z.ai 공개 평가26.2%7 / 70확인됨 ↗
Toolathlon VerifiedZ.ai 공개 평가59.9%7 / 70확인됨 ↗

추론·지식

벤치프로필점수순위백분위출처
GPQA DiamondLLM Stats 집계91.2%21 / 9078자기보고 ↗
GPQA DiamondHF 리더보드91.2%8 / 7090확인됨 ↗
Humanity's Last ExamLLM Stats 집계54.7%15 / 6479자기보고 ↗
Humanity's Last ExamHF 리더보드40.5%7 / 4887확인됨 ↗
AIME 2026LLM Stats 집계99.2%1 / 26100자기보고 ↗
NL2RepoLLM Stats 집계48.9%9 / 2262자기보고 ↗
HMMT 2025LLM Stats 집계94.4%7 / 1557자기보고 ↗
HMMT Feb 26LLM Stats 집계92.5%6 / 1358자기보고 ↗
Program BenchLLM Stats 집계63.7%5 / 1367자기보고 ↗
HLE · with toolsZ.ai 공개 평가54.7%7 / 70확인됨 ↗
CritPTLLM Stats 집계16.7%2 / 680자기보고 ↗
ProgramBench · Almost SolvedZ.ai 공개 평가9.5%6 / 60확인됨 ↗
NL2RepoZ.ai 공개 평가48.9%5 / 50확인됨 ↗

과학·보안

벤치프로필점수순위백분위출처
CyberGymZ.ai 공개 평가77.2%7 / 70확인됨 ↗
ExploitBenchZ.ai 공개 평가24.4%6 / 60확인됨 ↗

순위는 같은 프로필(같은 문항·하네스·출처)에서 측정된 모델 중 위치입니다. * 는 자기보고·인용 등 검증되지 않은 값입니다.

Hugging Face 다운로드 추이

30일 변화 -335.3K (-33.3%)
차트를 불러오는 중입니다…

Hugging Face가 제공하는 최근 30일 다운로드 집계를 매일 기록한 값입니다(누적 다운로드가 아님).

레이팅이 비슷한 모델

Z.ai (GLM)의 다른 모델

공급사 →