벤치마크 · 코딩

LiveCodeBench v6

LiveCodeBench v6 과제로 모델의 상대적인 문제 해결 성능을 비교합니다. 점수 하나로 전체 능력을 단정하지 말고 평가 조건을 함께 확인하세요.

측정 모델 51개 · 프로필 2개 · 데이터 기준 2026년 10월 9일

LLM Stats 집계 대표

원문 출처 ↗

LLM Stats 공개 리더보드의 독립 프로필입니다. 검증·자기보고 여부를 보존합니다. 높을수록 좋습니다.

현재 최고점: 상용 Qwen3.8 Flash 91.9% · 오픈 Qwen3.8-Flash-Next 91.9% → 상용이 0%p 앞섭니다.

출시일별 점수와 최고점 흐름

차트를 불러오는 중입니다…

상위 20

차트를 불러오는 중입니다…
출처
1Qwen3.8 FlashAlibaba (Qwen) · 상용 APIAPI91.9%992026-08-26자기보고 ↗
2Qwen3.8-Flash-NextAlibaba (Qwen) · 오픈 웨이트오픈91.9%992026-08-24자기보고 ↗
3Qwen3.7 MaxAlibaba (Qwen) · 상용 APIAPI91.6%962026-05-19자기보고 ↗
4Sakana NamazuSakana AI · 상용 APIAPI90.3%942026-08-03자기보고 ↗
5Qwen3.8-27BAlibaba (Qwen) · 오픈 웨이트오픈90.3%922026-08-05자기보고 ↗
6Kimi-K2.6Moonshot AI (Kimi) · 오픈 웨이트오픈89.6%892026-04-14자기보고 ↗
7Qwen3.7-PlusAlibaba (Qwen) · 상용 APIAPI89.6%892026-05-31자기보고 ↗
8Nemotron 3 Ultra (550B A55B)NVIDIA · 오픈 웨이트오픈89%862026-06-04자기보고 ↗
9Seed 2.0 ProByteDance (Seed) · 상용 APIAPI87.8%842026-02-14자기보고 ↗
10MAI-Thinking-1Microsoft · 상용 APIAPI87.7%822026-06-02자기보고 ↗
11Qwen3.6 PlusAlibaba (Qwen) · 상용 APIAPI87.1%802026-04-02자기보고 ↗
12Qwen3 Max ThinkingAlibaba (Qwen) · 상용 APIAPI85.9%782026-02-13자기보고 ↗
13Kimi-K2.5Moonshot AI (Kimi) · 오픈 웨이트오픈85%762026-01-01자기보고 ↗
14Qwen3.6-27BAlibaba (Qwen) · 오픈 웨이트오픈83.9%742026-04-21자기보고 ↗
15Qwen3.5-397B-A17BAlibaba (Qwen) · 오픈 웨이트오픈83.6%722026-02-16자기보고 ↗
16Kimi K2-Thinking-0905Moonshot AI (Kimi) · 오픈 웨이트오픈83.1%702025-09-05자기보고 ↗
17Ling-3.0-flashinclusionAI (Ant) · 오픈 웨이트오픈82.8%682026-08-02자기보고 ↗
18GPT OSS 120B HighOpenAI · 오픈 웨이트오픈81.9%662025-08-05자기보고 ↗
19Seed 2.0 LiteByteDance (Seed) · 상용 APIAPI81.7%642026-02-14자기보고 ↗
20EXAONE-4.5-33BLG AI Research (EXAONE) · 오픈 웨이트오픈81.4%622026-04-04자기보고 ↗
21K-EXAONE-236B-A23BLG AI Research (EXAONE) · 오픈 웨이트오픈80.7%592025-12-26자기보고 ↗
22Qwen3.5-27BAlibaba (Qwen) · 오픈 웨이트오픈80.7%592026-02-24자기보고 ↗
23Qwen3.6-35B-A3BAlibaba (Qwen) · 오픈 웨이트오픈80.4%562026-04-15자기보고 ↗
24Gemma 4 31BGoogle · 오픈 웨이트오픈80%542026-04-02자기보고 ↗
25Seed 1.8ByteDance (Seed) · 상용 APIAPI79.5%522026-02-17자기보고 ↗
26Qwen3.5-122B-A10BAlibaba (Qwen) · 오픈 웨이트오픈78.9%502026-02-24자기보고 ↗
27Gemma 4 26B-A4BGoogle · 오픈 웨이트오픈77.1%482026-04-02자기보고 ↗
28IBM Granite 4.2 30BIBM · 오픈 웨이트오픈75.8%462026-08-25자기보고 ↗
29Qwen3.5-35B-A3BAlibaba (Qwen) · 오픈 웨이트오픈74.6%442026-02-24자기보고 ↗
30IBM Granite 4.2 8BIBM · 오픈 웨이트오픈73.2%422026-08-25자기보고 ↗
31Gemma 4 12BGoogle · 오픈 웨이트오픈72%402026-05-23자기보고 ↗
32North-Mini-Code-1.0Cohere · 오픈 웨이트오픈70.3%382026-06-05자기보고 ↗
33Qwen3 VL 235B A22B ThinkingAlibaba (Qwen) · 오픈 웨이트오픈70.1%362025-09-22자기보고 ↗
34IBM Granite 4.2 3BIBM · 오픈 웨이트오픈69.7%342026-08-25자기보고 ↗
35DiffusionGemma 26B-A4BGoogle · 오픈 웨이트오픈69.1%322026-06-10자기보고 ↗
36Nemotron 3 Nano (30B A3B)NVIDIA · 상용 APIAPI68.3%302025-12-15자기보고 ↗
37Qwen3 VL 32B ThinkingAlibaba (Qwen) · 오픈 웨이트오픈65.6%272025-09-22자기보고 ↗
38Qwen3.5-9BAlibaba (Qwen) · 오픈 웨이트오픈65.6%272026-02-27자기보고 ↗
39Qwen3 VL 30B A3B ThinkingAlibaba (Qwen) · 오픈 웨이트오픈64.2%242025-09-22자기보고 ↗
40Seed 2.0 MiniByteDance (Seed) · 상용 APIAPI64.1%222026-02-17자기보고 ↗
41LFM2.5-2.6BLiquid AI · 상용 APIAPI59.4%202026-08-04자기보고 ↗
42Qwen3 VL 8B ThinkingAlibaba (Qwen) · 오픈 웨이트오픈58.6%182025-09-22자기보고 ↗
43Qwen3.5-4BAlibaba (Qwen) · 오픈 웨이트오픈55.8%162026-03-02자기보고 ↗
44Qwen3 VL 235B A22B InstructAlibaba (Qwen) · 오픈 웨이트오픈54.3%142025-09-22자기보고 ↗
45Gemma 4 E4BGoogle · 오픈 웨이트오픈52%122026-04-02자기보고 ↗
46Qwen3 VL 4B ThinkingAlibaba (Qwen) · 오픈 웨이트오픈51.3%102025-09-22자기보고 ↗
47Gemma 4 E2BGoogle · 오픈 웨이트오픈44%82026-04-02자기보고 ↗
48Qwen3 VL 32B InstructAlibaba (Qwen) · 오픈 웨이트오픈43.8%62025-09-22자기보고 ↗
49Qwen3 VL 30B A3B InstructAlibaba (Qwen) · 오픈 웨이트오픈42.6%42025-09-22자기보고 ↗
50Qwen3-VL-8B-InstructAlibaba (Qwen) · 오픈 웨이트오픈39.3%22025-10-11자기보고 ↗
51Qwen3 VL 4B InstructAlibaba (Qwen) · 오픈 웨이트오픈37.9%02025-09-22자기보고 ↗

Qwen 공개 평가

원문 출처 ↗

공급자가 같은 표에서 공개한 특정 평가 설정의 결과입니다. 하네스가 다른 리더보드 점수와 합치지 않습니다. 높을수록 좋습니다.

출시일별 점수와 최고점 흐름

차트를 불러오는 중입니다…

상위 20

차트를 불러오는 중입니다…
출처
1Qwen3.8-27BAlibaba (Qwen) · 오픈 웨이트오픈90.3%1002026-08-05확인됨 ↗
2Qwen3.6-27BAlibaba (Qwen) · 오픈 웨이트오픈83.9%02026-04-21확인됨 ↗

마커: 원 = 오픈 웨이트, 사각 = 상용 API, 빈 마커 = 검증되지 않은 값. 점을 누르면 모델 상세로 이동합니다. 백분위는 이 프로필 안에서의 상대 위치입니다.