Z.ai (GLM) · 모델

GLM-5.3

오픈출시 2026년 8월 25일zai-org/GLM-5.3Hugging Face ↗
종합 레이팅1390 · 8위가중 비교 18.3
컨텍스트 창—
가격 (입력 / 출력, 1M 토큰)오픈 웨이트
파라미터753BGlmMoeDsaForCausalLM
라이선스other
최근 30일 다운로드1.5M좋아요 2.1K · 7일 +170.1K
벤치 점수32개코딩·에이전트·추론·지식·과학·보안

AI AI 해설

2026년 10월 9일 생성

종합 레이팅 1309로 2위, 코딩·에이전트는 모두 4위

종합 평가

종합 레이팅은 1309로 2위이며 가중 비교는 10.3이다. 비슷한 모델은 GPT-5.6 Sol 1414, Claude Fable 5 1293, Hy4-preview 1291이다. 레이팅은 같은 벤치 비교를 바탕으로 한 상대 지표다.

분야별 역량

코딩 레이팅은 1196으로 4위, 에이전트는 1140으로 4위다. 추론·지식은 1077, 과학·보안은 1091이며 멀티모달은 자료 없음이다.

벤치 결과

HF 리더보드에서 Terminal-Bench 2.1은 88.2%로 3/28, DeepSWE는 66.9%로 6/21이다. LLM Stats 집계의 Terminal-Bench 2.1은 88.2%로 5/37이지만 미검증이다. 프로필이 달라 순위를 직접 비교할 수 없다.

도입 전 확인사항

오픈 웨이트 모델이며 라이선스는 other다. 컨텍스트, 최대 출력, 입력·출력 가격은 자료 없음이다. Z.ai 공개 평가에서는 GDPval-AA v2 1,769와 AutomationBench 1.0.6 48.2%, CyberGym 84.5%가 각각 1/7이다.

수집된 벤치·가격·출시 숫자만 입력으로 받아 LLM이 작성했고, 입력에 없는 숫자가 나오면 폐기합니다. 사용 결정은 원문 출처와 직접 평가로 확인하세요.

분야레이팅분야 순위비교 수
코딩126458
에이전트116984.3
추론·지식1156283.3
멀티모달———
과학·보안108242.7
차트를 불러오는 중입니다…

분야 레이팅은 그 분야 벤치에서의 비교만으로 계산합니다. 회색 선은 종합 1위 모델입니다.

벤치마크 점수

32개 · 프로필별 순위

코딩

벤치프로필점수순위백분위출처
Terminal-Bench 2.1LLM Stats 집계88.2%7 / 4386자기보고 ↗
DeepSWE 1.1LLM Stats 집계66.9%18 / 3955자기보고 ↗
Terminal-Bench 2.1HF 리더보드88.2%3 / 2893확인됨 ↗
DeepSWEHF 리더보드66.9%6 / 2175확인됨 ↗
Terminal-Bench 4.0LLM Stats 집계41.8%7 / 2170인용 ↗
FrontierSWELLM Stats 집계78.1%3 / 1788자기보고 ↗
PostTrainBenchLLM Stats 집계39.8%1 / 7100자기보고 ↗
Terminal-Bench 3.0Z.ai 공개 평가28.3%3 / 660확인됨 ↗
PostTrainBenchZ.ai 공개 평가39.8%2 / 680확인됨 ↗
SWE-Marathon 1.1Z.ai 공개 평가42.5%3 / 650확인됨 ↗
SWE-MarathonLLM Stats 집계42.5%1 / 5100자기보고 ↗
FrontierSWEZ.ai 공개 평가78.1%2 / 467확인됨 ↗
Terminal-Bench 3.0LLM Stats 집계28.3%2 / 350자기보고 ↗

에이전트

벤치프로필점수순위백분위출처
ToolathlonLLM Stats 집계73%8 / 3881자기보고 ↗
AutomationBenchLLM Stats 집계48.2%7 / 2474자기보고 ↗
Agents' Last ExamLLM Stats 집계28.5%14 / 2135자기보고 ↗
GDPval-AALLM Stats 집계1,7693 / 1180자기보고 ↗
GDPval-AA v2Z.ai 공개 평가1,7691 / 7100확인됨 ↗
Agents' Last Exam · CLIZ.ai 공개 평가28.5%2 / 783확인됨 ↗
AutomationBench 1.0.6Z.ai 공개 평가48.2%1 / 7100확인됨 ↗
Toolathlon VerifiedZ.ai 공개 평가73%6 / 717확인됨 ↗

추론·지식

벤치프로필점수순위백분위출처
Humanity's Last ExamLLM Stats 집계62.5%5 / 6494자기보고 ↗
NL2RepoLLM Stats 집계58%4 / 2286자기보고 ↗
Program BenchLLM Stats 집계19%12 / 138자기보고 ↗
HLE · with toolsZ.ai 공개 평가62.5%3 / 767확인됨 ↗
ProgramBench · Almost SolvedZ.ai 공개 평가19%3 / 660확인됨 ↗
NL2RepoZ.ai 공개 평가58%3 / 538확인됨 ↗

과학·보안

벤치프로필점수순위백분위출처
CyberGymLLM Stats 집계84.5%6 / 1972자기보고 ↗
ExploitBenchLLM Stats 집계54.4%4 / 857자기보고 ↗
ExploitGymLLM Stats 집계15%6 / 829자기보고 ↗
CyberGymZ.ai 공개 평가84.5%1 / 7100확인됨 ↗
ExploitBenchZ.ai 공개 평가54.4%3 / 660확인됨 ↗

순위는 같은 프로필(같은 문항·하네스·출처)에서 측정된 모델 중 위치입니다. * 는 자기보고·인용 등 검증되지 않은 값입니다.

Hugging Face 다운로드 추이

30일 변화 +745.4K (+93.1%)
차트를 불러오는 중입니다…

Hugging Face가 제공하는 최근 30일 다운로드 집계를 매일 기록한 값입니다(누적 다운로드가 아님).

레이팅이 비슷한 모델

Z.ai (GLM)의 다른 모델

공급사 →

관련 소식

euno.news 패밀리 기사