벤치마크 · 코딩

SciCode

과학 계산 문제를 코드로 구현하는 능력을 평가합니다. 도메인 지식과 프로그래밍을 함께 요구합니다.

측정 모델 101개 · 프로필 3개 · 데이터 기준 2026년 10월 9일

Artificial Analysis 대표

원문 출처 ↗

Artificial Analysis가 같은 조건으로 측정한 API 평가 스냅샷입니다. 높을수록 좋습니다.

현재 최고점: 상용 Claude Opus 5.5 66.9% · 오픈 MiMo-V2.6-Pro 60.9% → 상용이 6%p 앞섭니다.

출시일별 점수와 최고점 흐름

차트를 불러오는 중입니다…

상위 20

차트를 불러오는 중입니다…
출처
1Claude Opus 5.5Anthropic · 상용 APIAPI66.9%1002026-09-22확인됨 ↗
2Claude Fable 5.1Anthropic · 상용 APIAPI63.1%992026-09-01확인됨 ↗
3Claude Fable 5Anthropic · 상용 APIAPI61.0%972026-06-12확인됨 ↗
4Claude Sonnet 5.5Anthropic · 상용 APIAPI61.0%972026-09-28확인됨 ↗
5MiMo-V2.6-ProXiaomi (MiMo) · 오픈 웨이트오픈60.9%952026-09-22확인됨 ↗
6Gemini 3.7 FlashGoogle · 상용 APIAPI59.8%942026-08-13확인됨 ↗
7Kimi-K3Moonshot AI (Kimi) · 오픈 웨이트오픈59.5%932026-06-13확인됨 ↗
8GLM-5.3Z.ai (GLM) · 오픈 웨이트오픈59.0%922026-08-25확인됨 ↗
9Muse Spark 1.1Meta · 상용 APIAPI58.8%902026-07-09확인됨 ↗
10Muse Spark 1.3Meta · 상용 APIAPI58.8%902026-09-02확인됨 ↗
11Gemini 3.1 Pro PreviewGoogle · 상용 APIAPI58.7%882026-02-19확인됨 ↗
12GPT-6 SolOpenAI · 상용 APIAPI57.6%872026-09-22확인됨 ↗
13Muse Spark 1.2Meta · 상용 APIAPI57.4%862026-08-05확인됨 ↗
14GPT-5.6 SolOpenAI · 상용 APIAPI57.1%842026-07-09확인됨 ↗
15Gemini 3.8 FlashGoogle · 상용 APIAPI56.6%832026-09-02확인됨 ↗
16GPT-6 AstraOpenAI · 상용 APIAPI56.5%822026-09-03확인됨 ↗
17Claude Opus 5Anthropic · 상용 APIAPI56.4%812026-07-24확인됨 ↗
18GPT-5.5OpenAI · 상용 APIAPI55.8%802026-04-23확인됨 ↗
19Claude Haiku 5.5Anthropic · 상용 APIAPI55.0%772026-10-07확인됨 ↗
20GPT-5.6 TerraOpenAI · 상용 APIAPI55.0%772026-07-09확인됨 ↗
21Grok 4.5xAI · 상용 APIAPI55.0%772026-07-16확인됨 ↗
22GPT-6 LunaOpenAI · 상용 APIAPI54.6%752026-09-22확인됨 ↗
23Claude Opus 4.8Anthropic · 상용 APIAPI54.4%732026-05-14확인됨 ↗
24Claude Sonnet 5Anthropic · 상용 APIAPI54.3%722026-06-30확인됨 ↗
25GPT-6.1 SolOpenAI · 상용 APIAPI54.2%712026-09-29확인됨 ↗
26Ling 3.1 FlashinclusionAI (Ant) · 상용 APIAPI54.1%692026-09-30확인됨 ↗
27Qwen3.8-2.4T-A95BAlibaba (Qwen) · 오픈 웨이트오픈54.1%692026-08-08확인됨 ↗
28GPT-5.6 LunaOpenAI · 상용 APIAPI53.6%672026-07-09확인됨 ↗
29Gemini 3.6 FlashGoogle · 상용 APIAPI53.4%662026-07-21확인됨 ↗
30GPT-5.5 InstantOpenAI · 상용 APIAPI52.5%652026-05-05확인됨 ↗
31GPT-5.4 miniOpenAI · 상용 APIAPI52.1%632026-03-17확인됨 ↗
32Qwen3.8 MaxAlibaba (Qwen) · 상용 APIAPI52.1%632026-08-02확인됨 ↗
33DeepSeek-V4.1-FlashDeepSeek · 오픈 웨이트오픈51.9%612026-09-10확인됨 ↗
34GLM-5.3-FlashZ.ai (GLM) · 오픈 웨이트오픈51.6%602026-08-25확인됨 ↗
35Kimi-K2.6Moonshot AI (Kimi) · 오픈 웨이트오픈51.5%592026-04-14확인됨 ↗
36MiMo-V2.6-FlashXiaomi (MiMo) · 오픈 웨이트오픈51.3%582026-09-22확인됨 ↗
37GLM-5.2Z.ai (GLM) · 오픈 웨이트오픈51.2%572026-06-16확인됨 ↗
38DeepSeek-V4-Pro-0813DeepSeek · 오픈 웨이트오픈51.0%552026-08-13확인됨 ↗
39MiMo-V2.5-ProXiaomi (MiMo) · 오픈 웨이트오픈50.6%542026-04-27확인됨 ↗
40Qwen3.8-Flash-NextAlibaba (Qwen) · 오픈 웨이트오픈50.6%542026-08-24확인됨 ↗
41DeepSeek-V4-Flash-0731DeepSeek · 오픈 웨이트오픈50.3%522026-07-31확인됨 ↗
42Claude Sonnet 4.6Anthropic · 상용 APIAPI50.1%502026-02-17확인됨 ↗
43MiniMax-M2.7MiniMax · 오픈 웨이트오픈50.1%502026-04-09확인됨 ↗
44Inkling-SmallThinking Machines · 오픈 웨이트오픈49.7%482026-07-27확인됨 ↗
45Qwen3.7 MaxAlibaba (Qwen) · 상용 APIAPI49.5%472026-05-19확인됨 ↗
46Hy3Tencent · 오픈 웨이트오픈48.6%462026-07-02확인됨 ↗
47Solar-Open2-250BUpstage (Solar) · 오픈 웨이트오픈48.0%452026-07-22확인됨 ↗
48Kimi-K2.7-CodeMoonshot AI (Kimi) · 오픈 웨이트오픈47.8%432026-06-11확인됨 ↗
49Solar Mini 4Upstage (Solar) · 상용 APIAPI47.6%422026-09-22확인됨 ↗
50GPT-5.4 nanoOpenAI · 상용 APIAPI47.2%412026-03-17확인됨 ↗
51MiniMax-M3MiniMax · 오픈 웨이트오픈47.1%402026-06-02확인됨 ↗
52InklingThinking Machines · 오픈 웨이트오픈47.0%392026-07-14확인됨 ↗
53Qwen3.8-27BAlibaba (Qwen) · 오픈 웨이트오픈46.6%372026-08-05확인됨 ↗
54Qwen3.7-PlusAlibaba (Qwen) · 상용 APIAPI46.1%362026-05-31확인됨 ↗
55Gemma 4 31BGoogle · 오픈 웨이트오픈45.5%352026-04-02확인됨 ↗
56Ring-2.6-1TinclusionAI (Ant) · 오픈 웨이트오픈45.0%342026-05-14확인됨 ↗
57GLM-5.1Z.ai (GLM) · 오픈 웨이트오픈44.8%332026-04-03확인됨 ↗
58Solar Pro 4Upstage (Solar) · 상용 APIAPI44.6%312026-08-06확인됨 ↗
59MiMo-V2.5Xiaomi (MiMo) · 오픈 웨이트오픈43.9%302026-04-27확인됨 ↗
60Step-3.7-FlashStepFun · 오픈 웨이트오픈43.9%302026-05-23확인됨 ↗
61Gemini 3.1 Flash-LiteGoogle · 상용 APIAPI43.4%282026-03-03확인됨 ↗
62Nex-N2-Pronex-agi · 오픈 웨이트오픈43.3%272026-06-03확인됨 ↗
63Qwen3.6-27BAlibaba (Qwen) · 오픈 웨이트오픈42.8%252026-04-21확인됨 ↗
64Claude Haiku 4.5Anthropic · 상용 APIAPI42.2%242025-10-15확인됨 ↗
65Ling-3.0-flashinclusionAI (Ant) · 오픈 웨이트오픈42.0%232026-08-02확인됨 ↗
66Gemini 3.5 Flash-LiteGoogle · 상용 APIAPI41.3%222026-07-21확인됨 ↗
67A.X-K2SK Telecom · 오픈 웨이트오픈41.0%202026-07-28확인됨 ↗
68Nemotron 3 Ultra (550B A55B)NVIDIA · 오픈 웨이트오픈40.3%192026-06-04확인됨 ↗
69Mistral Medium 3.5Mistral AI · 상용 APIAPI40.2%182026-04-29확인됨 ↗
70Gemma 4 26B-A4BGoogle · 오픈 웨이트오픈40.0%172026-04-02확인됨 ↗
71DeepSeek-V3-0324DeepSeek · 오픈 웨이트오픈39.0%162025-03-24확인됨 ↗
72Mistral Small 4Mistral AI · 오픈 웨이트오픈38.8%142026-03-16확인됨 ↗
73Command A+Cohere · 오픈 웨이트오픈38.5%132026-05-20확인됨 ↗
74DeepSeek-R1DeepSeek · 오픈 웨이트오픈38.3%122025-01-20확인됨 ↗
75Mercury 2Inception · 상용 APIAPI37.7%112026-02-24확인됨 ↗
76Qwen3.6-35B-A3BAlibaba (Qwen) · 오픈 웨이트오픈36.6%102026-04-15확인됨 ↗
77LongCat-2.0Meituan (LongCat) · 오픈 웨이트오픈36.3%82026-07-05확인됨 ↗
78Nemotron 3 Super (120B A12B)NVIDIA · 상용 APIAPI36.2%72026-03-11확인됨 ↗
79Qwen3-Coder-NextAlibaba (Qwen) · 오픈 웨이트오픈36.2%72026-01-30확인됨 ↗
80DeepSeek-V3DeepSeek · 오픈 웨이트오픈35.8%52024-12-25확인됨 ↗
81Qwen3-8BAlibaba (Qwen) · 오픈 웨이트오픈27.9%42025-04-27확인됨 ↗
82MiniCPM5-2BOpenBMB · 오픈 웨이트오픈26.3%22026-09-06확인됨 ↗
83Gemma 4 E4BGoogle · 오픈 웨이트오픈24.4%12026-04-02확인됨 ↗
84LFM2.5-2.6BLiquid AI · 상용 APIAPI14.4%02026-08-04확인됨 ↗

LLM Stats 집계

원문 출처 ↗

LLM Stats 공개 리더보드의 독립 프로필입니다. 검증·자기보고 여부를 보존합니다. 높을수록 좋습니다.

현재 최고점: 상용 Mistral Large 4 91.8% · 오픈 Kimi-K2.6 52.2% → 상용이 39.6%p 앞섭니다.

출시일별 점수와 최고점 흐름

차트를 불러오는 중입니다…

상위 20

차트를 불러오는 중입니다…
출처
1Mistral Large 4Mistral AI · 상용 APIAPI91.8%1002026-10-06자기보고 ↗
2Seed 2.1 ProByteDance (Seed) · 상용 APIAPI59.8%962026-06-24자기보고 ↗
3Gemini 3.1 ProGoogle · 상용 APIAPI59%922026-02-19자기보고 ↗
4Seed 2.1 TurboByteDance (Seed) · 상용 APIAPI57.8%882026-06-24자기보고 ↗
5Qwen3.7 MaxAlibaba (Qwen) · 상용 APIAPI53.5%842026-05-19자기보고 ↗
6Kimi-K2.6Moonshot AI (Kimi) · 오픈 웨이트오픈52.2%802026-04-14자기보고 ↗
7Qwen3.7-PlusAlibaba (Qwen) · 상용 APIAPI51.3%762026-05-31자기보고 ↗
8Inkling-SmallThinking Machines · 오픈 웨이트오픈48.7%702026-07-27자기보고 ↗
9Kimi-K2.5Moonshot AI (Kimi) · 오픈 웨이트오픈48.7%702026-01-01자기보고 ↗
10Solar Mini 4Upstage (Solar) · 상용 APIAPI47.6%642026-09-22인용 ↗
11Kimi K2-Thinking-0905Moonshot AI (Kimi) · 오픈 웨이트오픈44.8%602025-09-05자기보고 ↗
12Nemotron 3 Ultra (550B A55B)NVIDIA · 오픈 웨이트오픈44.6%562026-06-04자기보고 ↗
13Muse-Glimmer-30BMeta · 오픈 웨이트오픈43.6%522026-08-09자기보고 ↗
14Nemotron 3 Super (120B A12B)NVIDIA · 상용 APIAPI42.1%482026-03-11자기보고 ↗
15GLM-4.5Z.ai (GLM) · 오픈 웨이트오픈41.7%442025-07-20자기보고 ↗
16MiniMax-M2.1MiniMax · 오픈 웨이트오픈39%402025-12-20자기보고 ↗
17IBM Granite 4.2 30BIBM · 오픈 웨이트오픈38.8%362026-08-25자기보고 ↗
18North-Mini-Code-1.0Cohere · 오픈 웨이트오픈38.2%322026-06-05자기보고 ↗
19Command A+Cohere · 오픈 웨이트오픈38%262026-05-20자기보고 ↗
20Mercury 2Inception · 상용 APIAPI38%262026-02-24자기보고 ↗
21GLM-4.5-AirZ.ai (GLM) · 오픈 웨이트오픈37.3%202025-07-20자기보고 ↗
22IBM Granite 4.2 8BIBM · 오픈 웨이트오픈36.1%162026-08-25자기보고 ↗
23MiniMax-M2MiniMax · 오픈 웨이트오픈36%122025-10-22자기보고 ↗
24Nemotron 3 Nano (30B A3B)NVIDIA · 상용 APIAPI33.3%82025-12-15자기보고 ↗
25Nemotron 3.5 Lightning (30B A3B)NVIDIA · 오픈 웨이트오픈32.6%42026-08-11자기보고 ↗
26IBM Granite 4.2 3BIBM · 오픈 웨이트오픈24.1%02026-08-25자기보고 ↗

Muse 공개 평가

원문 출처 ↗

공급자가 같은 표에서 공개한 특정 평가 설정의 결과입니다. 하네스가 다른 리더보드 점수와 합치지 않습니다. 높을수록 좋습니다.

출시일별 점수와 최고점 흐름

차트를 불러오는 중입니다…

상위 20

차트를 불러오는 중입니다…
출처
1Muse-Glimmer-30BMeta · 오픈 웨이트오픈43.6%1002026-08-09확인됨 ↗
2Qwen3.6-27BAlibaba (Qwen) · 오픈 웨이트오픈39.8%02026-04-21인용 ↗

마커: 원 = 오픈 웨이트, 사각 = 상용 API, 빈 마커 = 검증되지 않은 값. 점을 누르면 모델 상세로 이동합니다. 백분위는 이 프로필 안에서의 상대 위치입니다.