Z.ai (GLM) · 모델
GLM-4.5
AI AI 해설
2026년 10월 9일 생성GLM-4.5는 종합 레이팅 910(104위)의 오픈 웨이트 모델
레이팅
종합 레이팅은 910(104위), 가중 비교는 6이다. 코딩 909(82위), 에이전트 930, 추론·지식 991(76위)다. 레이팅은 같은 벤치 비교로 만든 상대 지표다.
주요 벤치
LLM Stats 집계에서 BFCL-v3 77.8%(1/13), LiveCodeBench 72.9%(9/13), Terminal-Bench 37.5%(5/9), SWE-bench Verified 64.2%(52/58)다. 모두 미검증 수치다.
프로필별 해석
MMLU-Pro는 LLM Stats 집계 84.6%(22/60), HF 리더보드 84.6%(17/53)다. Humanity's Last Exam은 각각 14.4%(58/64), 8.3%(47/48)다. 출처·하네스가 달라 점수를 직접 비교하면 안 된다.
도입 전 확인
mit 라이선스의 오픈 웨이트 모델이다. 컨텍스트, 최대 출력, 입력·출력 가격은 자료 없음이다. 멀티모달과 과학·보안 분야 레이팅도 자료 없음이며, 제시된 벤치 점수는 모두 미검증이다.
수집된 벤치·가격·출시 숫자만 입력으로 받아 LLM이 작성했고, 입력에 없는 숫자가 나오면 폐기합니다. 사용 결정은 원문 출처와 직접 평가로 확인하세요.
분야별 레이팅
비슷한 모델과 비교 →| 분야 | 레이팅 | 분야 순위 | 벤치 수 |
|---|---|---|---|
| 코딩 | 136 | 5 | |
| 에이전트 | — | 1 | |
| 추론·지식 | 157 | 14 | |
| 멀티모달 | — | — | — |
| 과학·보안 | 80 | 2 |
분야 레이팅은 그 분야 벤치에서의 비교만으로 계산합니다. 회색 선은 종합 1위 모델입니다.
벤치마크 점수
26개 · 프로필별 순위코딩
| 벤치 | 프로필 | 점수 | 순위 | 백분위 | 출처 |
|---|---|---|---|---|---|
| Terminal-Bench Hard | Artificial Analysis | 22.0% | 58 / 93 | 38 | 확인됨 ↗ |
| SWE-bench Verified | LLM Stats 집계 | 64.2% | 52 / 58 | 11 | 자기보고 ↗ |
| SciCode | LLM Stats 집계 | 41.7% | 15 / 26 | 44 | 자기보고 ↗ |
| LiveCodeBench | LLM Stats 집계 | 72.9% | 9 / 13 | 33 | 자기보고 ↗ |
| Terminal-Bench | LLM Stats 집계 | 37.5% | 5 / 9 | 50 | 자기보고 ↗ |
에이전트
| 벤치 | 프로필 | 점수 | 순위 | 백분위 | 출처 |
|---|---|---|---|---|---|
| BrowseComp | LLM Stats 집계 | 26.4% | 46 / 47 | 2 | 자기보고 ↗ |
추론·지식
| 벤치 | 프로필 | 점수 | 순위 | 백분위 | 출처 |
|---|---|---|---|---|---|
| Humanity's Last Exam | Artificial Analysis | 13.0% | 102 / 141 | 28 | 확인됨 ↗ |
| Intelligence Index | Artificial Analysis | 12.8 | 108 / 141 | 24 | 확인됨 ↗ |
| AA-LCR | Artificial Analysis | 52.7% | 107 / 139 | 24 | 확인됨 ↗ |
| CritPT | Artificial Analysis | 0% | 114 / 139 | 12 | 확인됨 ↗ |
| GPQA Diamond | Artificial Analysis | 78.2% | 87 / 130 | 33 | 확인됨 ↗ |
| IFBench | Artificial Analysis | 44.1% | 71 / 97 | 27 | 확인됨 ↗ |
| τ²-Bench Telecom | Artificial Analysis | 43.0% | 71 / 96 | 26 | 확인됨 ↗ |
| GPQA Diamond | LLM Stats 집계 | 79.1% | 65 / 90 | 28 | 자기보고 ↗ |
| Humanity's Last Exam | LLM Stats 집계 | 14.4% | 58 / 64 | 10 | 자기보고 ↗ |
| MMLU-Pro | LLM Stats 집계 | 84.6% | 22 / 60 | 64 | 자기보고 ↗ |
| MMLU-Pro | HF 리더보드 | 84.6% | 17 / 53 | 69 | 인용 ↗ |
| Humanity's Last Exam | HF 리더보드 | 8.3% | 47 / 48 | 2 | 인용 ↗ |
| BFCL-v3 | LLM Stats 집계 | 77.8% | 1 / 13 | 100 | 자기보고 ↗ |
| AA-Index | LLM Stats 집계 | 67.7% | 1 / 3 | 100 | 자기보고 ↗ |
| AIME 2024 | LLM Stats 집계 | 91% | 1 / 2 | 100 | 자기보고 ↗ |
| MATH-500 | LLM Stats 집계 | 98.2% | 1 / 2 | 100 | 자기보고 ↗ |
| TAU-bench Airline | LLM Stats 집계 | 60.4% | 2 / 2 | 0 | 자기보고 ↗ |
| TAU-bench Retail | LLM Stats 집계 | 79.7% | 1 / 2 | 100 | 자기보고 ↗ |
과학·보안
| 벤치 | 프로필 | 점수 | 순위 | 백분위 | 출처 |
|---|---|---|---|---|---|
| AA-Omniscience Accuracy | Artificial Analysis | 25.1% | 75 / 139 | 46 | 확인됨 ↗ |
| AA-Omniscience Index | Artificial Analysis | -27.4 | 86 / 139 | 38 | 확인됨 ↗ |
순위는 같은 프로필(같은 문항·하네스·출처)에서 측정된 모델 중 위치입니다. * 는 자기보고·인용 등 검증되지 않은 값입니다.
Hugging Face 다운로드 추이
30일 변화 +34.0K (+37.7%)Hugging Face가 제공하는 최근 30일 다운로드 집계를 매일 기록한 값입니다(누적 다운로드가 아님).
레이팅이 비슷한 모델
- Nova 2 Omni 156위 · 842 비교
- Nova 2 Lite 157위 · 839 비교
- A.X-K1 158위 · 837 비교
- Qwen3-4B-Thinking-2507 160위 · 831 비교
- Command A+ 161위 · 825 비교
- Qwen3 VL 32B Thinking 162위 · 825 비교
Z.ai (GLM)의 다른 모델
공급사 →- GLM-5.3-Flash-BF16 2026-08-25
- GLM-5.3-BF16 2026-08-25
- GLM-5.3-Flash 2026-08-25 · 1319
- GLM-5.3 2026-08-25 · 1470
- GLM-5.2 2026-06-16 · 1199
- GLM-5.2-FP8 2026-06-16
- GLM-5.1-FP8 2026-04-03
- GLM-5.1 2026-04-03 · 1104