벤치마크 · 추론·지식

Humanity's Last Exam

여러 분야 전문가가 만든 최고 난도 문항으로 현재 모델의 한계를 측정합니다.

측정 모델 95개 · 프로필 3개 · 데이터 기준 2026년 10월 9일

LLM Stats 집계 대표

원문 출처 ↗

LLM Stats 공개 리더보드의 독립 프로필입니다. 검증·자기보고 여부를 보존합니다. 높을수록 좋습니다.

현재 최고점: 상용 Claude Fable 5.1 65% · 오픈 GLM-5.3 62.5% → 상용이 2.5%p 앞섭니다.

출시일별 점수와 최고점 흐름

차트를 불러오는 중입니다…

상위 20

차트를 불러오는 중입니다…
출처
1Claude Fable 5.1Anthropic · 상용 APIAPI65%1002026-09-01자기보고 ↗
2Claude Mythos PreviewAnthropic · 상용 APIAPI64.7%982026-05-28자기보고 ↗
3Claude Opus 5Anthropic · 상용 APIAPI64.7%982026-07-24자기보고 ↗
4Claude Fable 5Anthropic · 상용 APIAPI64.5%952026-06-12자기보고 ↗
5GLM-5.3Z.ai (GLM) · 오픈 웨이트오픈62.5%942026-08-25자기보고 ↗
6Muse Spark 1.1Meta · 상용 APIAPI62.1%922026-07-09자기보고 ↗
7DeepSeek-V4-Pro-0813DeepSeek · 오픈 웨이트오픈60%902026-08-13자기보고 ↗
8Muse SparkMeta · 상용 APIAPI58.4%892026-04-08자기보고 ↗
9Claude Opus 4.8Anthropic · 상용 APIAPI57.9%872026-05-14자기보고 ↗
10Claude Sonnet 5Anthropic · 상용 APIAPI57.4%862026-06-30자기보고 ↗
11Kimi-K3Moonshot AI (Kimi) · 오픈 웨이트오픈56%842026-06-13자기보고 ↗
12Seed 2.1 ProByteDance (Seed) · 상용 APIAPI55.7%832026-06-24자기보고 ↗
13GLM-5.3-FlashZ.ai (GLM) · 오픈 웨이트오픈55.3%812026-08-25자기보고 ↗
14Claude Opus 4.7Anthropic · 상용 APIAPI54.7%792026-04-16자기보고 ↗
15GLM-5.2Z.ai (GLM) · 오픈 웨이트오픈54.7%792026-06-16자기보고 ↗
16Seed 2.1 TurboByteDance (Seed) · 상용 APIAPI54.6%762026-06-24자기보고 ↗
17Claude Opus 4.6Anthropic · 상용 APIAPI53.1%752026-02-05자기보고 ↗
18GLM-5.1Z.ai (GLM) · 오픈 웨이트오픈52.3%732026-04-03자기보고 ↗
19GPT-5.5OpenAI · 상용 APIAPI52.2%712026-04-23자기보고 ↗
20Gemini 3.1 ProGoogle · 상용 APIAPI51.4%702026-02-19자기보고 ↗
21Kimi K2-Thinking-0905Moonshot AI (Kimi) · 오픈 웨이트오픈51%682025-09-05자기보고 ↗
22Kimi-K2.5Moonshot AI (Kimi) · 오픈 웨이트오픈50.2%672026-01-01자기보고 ↗
23Claude Sonnet 4.6Anthropic · 상용 APIAPI49%652026-02-17자기보고 ↗
24Qwen3.5-27BAlibaba (Qwen) · 오픈 웨이트오픈48.5%632026-02-24자기보고 ↗
25DeepSeek-V4-Pro-MaxDeepSeek · 오픈 웨이트오픈48.2%622026-04-23자기보고 ↗
26Qwen3.5-122B-A10BAlibaba (Qwen) · 오픈 웨이트오픈47.5%602026-02-24자기보고 ↗
27Qwen3.5-35B-A3BAlibaba (Qwen) · 오픈 웨이트오픈47.4%592026-02-24자기보고 ↗
28Gemini 3 ProGoogle · 상용 APIAPI45.8%572025-11-18자기보고 ↗
29DeepSeek-V4-Flash-MaxDeepSeek · 오픈 웨이트오픈45.1%562026-04-23자기보고 ↗
30Qwen3.8 MaxAlibaba (Qwen) · 상용 APIAPI43.6%542026-08-02자기보고 ↗
31Gemini 3 FlashGoogle · 상용 APIAPI43.5%522025-12-17자기보고 ↗
32Qwen3.7 MaxAlibaba (Qwen) · 상용 APIAPI41.4%512026-05-19자기보고 ↗
33DeepSeek-V4-Flash-0423DeepSeek · 오픈 웨이트오픈40.3%492026-04-23자기보고 ↗
34Gemini 3.5 FlashGoogle · 상용 APIAPI40.2%482026-05-19자기보고 ↗
35GPT-5.4OpenAI · 상용 APIAPI39.8%462026-03-05자기보고 ↗
36Nemotron 3 Ultra (550B A55B)NVIDIA · 오픈 웨이트오픈37.4%442026-06-04자기보고 ↗
37DeepSeek-V4.1-FlashDeepSeek · 오픈 웨이트오픈36.8%432026-09-10자기보고 ↗
38Kimi-K2.6Moonshot AI (Kimi) · 오픈 웨이트오픈36.4%412026-04-14자기보고 ↗
39Qwen3.8 FlashAlibaba (Qwen) · 상용 APIAPI35.9%392026-08-26자기보고 ↗
40Qwen3.8-Flash-NextAlibaba (Qwen) · 오픈 웨이트오픈35.9%392026-08-24자기보고 ↗
41Qwen3.7-PlusAlibaba (Qwen) · 상용 APIAPI34.7%372026-05-31자기보고 ↗
42GPT-5.2OpenAI · 상용 APIAPI34.5%352025-12-11자기보고 ↗
43Inkling-SmallThinking Machines · 오픈 웨이트오픈31.6%332026-07-27자기보고 ↗
44Qwen3.8-27BAlibaba (Qwen) · 오픈 웨이트오픈30.8%322026-08-05자기보고 ↗
45Qwen3.6 PlusAlibaba (Qwen) · 상용 APIAPI28.8%302026-04-02자기보고 ↗
46Qwen3.5-397B-A17BAlibaba (Qwen) · 오픈 웨이트오픈28.7%292026-02-16자기보고 ↗
47GPT-5.4 miniOpenAI · 상용 APIAPI28.2%272026-03-17자기보고 ↗
48Gemma 4 31BGoogle · 오픈 웨이트오픈26.5%252026-04-02자기보고 ↗
49GPT-5.4 nanoOpenAI · 상용 APIAPI24.3%242026-03-17자기보고 ↗
50Qwen3.6-27BAlibaba (Qwen) · 오픈 웨이트오픈24%222026-04-21자기보고 ↗
51Nemotron 3 Super (120B A12B)NVIDIA · 상용 APIAPI22.8%212026-03-11자기보고 ↗
52MiniMax-M2.1MiniMax · 오픈 웨이트오픈22%182025-12-20자기보고 ↗
53Muse-Glimmer-30BMeta · 오픈 웨이트오픈22%182026-08-09자기보고 ↗
54Qwen3.6-35B-A3BAlibaba (Qwen) · 오픈 웨이트오픈21.4%162026-04-15자기보고 ↗
55MAI-Code-1-FlashMicrosoft · 상용 APIAPI18%142026-06-02자기보고 ↗
56Gemma 4 26B-A4BGoogle · 오픈 웨이트오픈17.2%132026-04-02자기보고 ↗
57Nemotron 3 Nano (30B A3B)NVIDIA · 상용 APIAPI15.5%112025-12-15자기보고 ↗
58GLM-4.5Z.ai (GLM) · 오픈 웨이트오픈14.4%102025-07-20자기보고 ↗
59Qwen3 VL 235B A22B ThinkingAlibaba (Qwen) · 오픈 웨이트오픈13.6%82025-09-22자기보고 ↗
60MiniMax-M2MiniMax · 오픈 웨이트오픈12.5%62025-10-22자기보고 ↗
61DiffusionGemma 26B-A4BGoogle · 오픈 웨이트오픈11.9%52026-06-10자기보고 ↗
62Nemotron 3.5 Lightning (30B A3B)NVIDIA · 오픈 웨이트오픈11.7%32026-08-11자기보고 ↗
63GLM-4.5-AirZ.ai (GLM) · 오픈 웨이트오픈10.6%22025-07-20자기보고 ↗
64Gemma 4 12BGoogle · 오픈 웨이트오픈5.2%02026-05-23자기보고 ↗

HF 리더보드

원문 출처 ↗

같은 Hugging Face 리더보드 데이터셋·과제의 결과만 표시합니다. 높을수록 좋습니다.

출시일별 점수와 최고점 흐름

차트를 불러오는 중입니다…

상위 20

차트를 불러오는 중입니다…
출처
1Kimi-K3Moonshot AI (Kimi) · 오픈 웨이트오픈56%1002026-06-13확인됨 ↗
2Hy3Tencent · 오픈 웨이트오픈53.2%982026-07-02확인됨 ↗
3InklingThinking Machines · 오픈 웨이트오픈46%962026-07-14확인됨 ↗
4Ornith-1.5-397Bornith-ai · 오픈 웨이트오픈44.6%942026-08-18확인됨 ↗
5Qwen3.8-2.4T-A95BAlibaba (Qwen) · 오픈 웨이트오픈43.6%912026-08-08확인됨 ↗
6Hy4-previewTencent · 오픈 웨이트오픈43.4%892026-08-27확인됨 ↗
7GLM-5.2Z.ai (GLM) · 오픈 웨이트오픈40.5%872026-06-16확인됨 ↗
8DeepSeek-V4-ProDeepSeek · 오픈 웨이트오픈37.7%852026-04-22확인됨 ↗
9DeepSeek-V4.1-FlashDeepSeek · 오픈 웨이트오픈36.8%832026-09-10확인됨 ↗
10Qwen3.8-Flash-NextAlibaba (Qwen) · 오픈 웨이트오픈35.9%812026-08-24확인됨 ↗
11DeepSeek-V4-FlashDeepSeek · 오픈 웨이트오픈34.8%792026-04-22확인됨 ↗
12Kimi-K2.6Moonshot AI (Kimi) · 오픈 웨이트오픈34.7%772026-04-14확인됨 ↗
13Inkling-SmallThinking Machines · 오픈 웨이트오픈31.6%742026-07-27확인됨 ↗
14GLM-5.1Z.ai (GLM) · 오픈 웨이트오픈31%712026-04-03확인됨 ↗
15GLM-5.1-MXFP4-Mixed-CT-AutoRoundINCModel3 · 오픈 웨이트오픈31%712026-08-31인용 ↗
16Qwen3.8-27BAlibaba (Qwen) · 오픈 웨이트오픈30.8%682026-08-05확인됨 ↗
17GLM-5Z.ai (GLM) · 오픈 웨이트오픈30.5%662026-02-11확인됨 ↗
18Hy3-previewTencent · 오픈 웨이트오픈30%642026-04-13확인됨 ↗
19Solar-Open2-250BUpstage (Solar) · 오픈 웨이트오픈28.8%622026-07-22확인됨 ↗
20Qwen3.5-397B-A17BAlibaba (Qwen) · 오픈 웨이트오픈28.7%602026-02-16확인됨 ↗
21A.X-K2SK Telecom · 오픈 웨이트오픈27.8%572026-07-28확인됨 ↗
22NVIDIA-Nemotron-3-Ultra-550B-A55B-BF16NVIDIA · 오픈 웨이트오픈26.7%552026-06-03확인됨 ↗
23NVIDIA-Nemotron-3-Ultra-550B-A55B-NVFP4NVIDIA · 오픈 웨이트오픈26.1%532026-06-03확인됨 ↗
24Ornith-1.5-35B-A3Bornith-ai · 오픈 웨이트오픈25.6%512026-08-18확인됨 ↗
25Qwen3.5-122B-A10BAlibaba (Qwen) · 오픈 웨이트오픈25.3%492026-02-24확인됨 ↗
26GLM-4.7Z.ai (GLM) · 오픈 웨이트오픈24.8%472025-12-22확인됨 ↗
27Kimi-K2.5Moonshot AI (Kimi) · 오픈 웨이트오픈24.4%452026-01-01인용 ↗
28Qwen3.5-27BAlibaba (Qwen) · 오픈 웨이트오픈24.3%432026-02-24확인됨 ↗
29Qwen3.6-27BAlibaba (Qwen) · 오픈 웨이트오픈24%402026-04-21확인됨 ↗
30Kimi-K2-ThinkingMoonshot AI (Kimi) · 오픈 웨이트오픈23.9%382025-11-04확인됨 ↗
31Step-3.5-FlashStepFun · 오픈 웨이트오픈23.1%362026-02-01인용 ↗
32Ling-3.0-flashinclusionAI (Ant) · 오픈 웨이트오픈22.7%342026-08-02확인됨 ↗
33MiniMax-M2.1MiniMax · 오픈 웨이트오픈22.2%322025-12-20확인됨 ↗
34Muse-Glimmer-30BMeta · 오픈 웨이트오픈22%302026-08-09확인됨 ↗
35Intern-S2-PreviewShanghai AI Lab (InternLM) · 오픈 웨이트오픈21.9%282026-05-15확인됨 ↗
36Qwen3.6-35B-A3BAlibaba (Qwen) · 오픈 웨이트오픈21.4%262026-04-15확인됨 ↗
37Ornith-1.5-9Bornith-ai · 오픈 웨이트오픈20.2%232026-08-18확인됨 ↗
38MiniMax-M2.5MiniMax · 오픈 웨이트오픈19.4%212026-02-12확인됨 ↗
39NVIDIA-Nemotron-3-Super-120B-A12B-BF16NVIDIA · 오픈 웨이트오픈18.3%182026-03-10확인됨 ↗
40NVIDIA-Nemotron-3-Super-120B-A12B-BF16RedHatAI · 오픈 웨이트오픈18.3%182026-03-26인용 ↗
41GLM-4.7-FlashZ.ai (GLM) · 오픈 웨이트오픈14.4%152026-01-19확인됨 ↗
42K-EXAONE-236B-A23BLG AI Research (EXAONE) · 오픈 웨이트오픈13.6%132025-12-26확인됨 ↗
43MiniMax-M2MiniMax · 오픈 웨이트오픈12.5%112025-10-22확인됨 ↗
44NVIDIA-Nemotron-3.5-Lightning-30B-A3B-BF16NVIDIA · 오픈 웨이트오픈11.7%92026-08-01확인됨 ↗
45NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4NVIDIA · 오픈 웨이트오픈10.5%62026-08-04확인됨 ↗
46A.X-K1SK Telecom · 오픈 웨이트오픈8.6%42025-12-29확인됨 ↗
47GLM-4.5Z.ai (GLM) · 오픈 웨이트오픈8.3%22025-07-20인용 ↗
48GLM-4.5-AirZ.ai (GLM) · 오픈 웨이트오픈8.1%02025-07-20인용 ↗

Artificial Analysis

원문 출처 ↗

Artificial Analysis가 같은 조건으로 측정한 API 평가 스냅샷입니다. 높을수록 좋습니다.

출시일별 점수와 최고점 흐름

차트를 불러오는 중입니다…

상위 20

차트를 불러오는 중입니다…
출처
1Claude Opus 5Anthropic · 상용 APIAPI54.9%1002026-07-24인용 ↗
2Gemini 3.7 FlashGoogle · 상용 APIAPI47.9%672026-08-13인용 ↗
3GPT-5.3-CodexOpenAI · 상용 APIAPI42.5%332026-02-05인용 ↗
4Claude Sonnet 5Anthropic · 상용 APIAPI41.3%02026-06-30인용 ↗

마커: 원 = 오픈 웨이트, 사각 = 상용 API, 빈 마커 = 검증되지 않은 값. 점을 누르면 모델 상세로 이동합니다. 백분위는 이 프로필 안에서의 상대 위치입니다.