종합 레이팅1087 · 80위레이팅 벤치 19개
컨텍스트 창1.0M
가격 (입력 / 출력, 1M 토큰)$0.090 / $0.180혼합 $0.113
파라미터284B
라이선스—
최근 30일 다운로드0좋아요 0
벤치 점수19개코딩·에이전트·추론·지식
AI AI 해설
2026년 10월 9일 생성저비용·장문 컨텍스트를 갖춘 오픈 웨이트 코딩·추론 모델
핵심 사양
DeepSeek의 오픈 웨이트 모델이다. 컨텍스트는 1.0M이며 가격은 1M 토큰당 입력 $0.090, 출력 $0.180이다. 최대 출력과 라이선스는 자료 없음이다.
종합·분야 레이팅
종합 레이팅은 1067(66위), 가중 비교는 9.5다. 코딩은 1035(47위), 에이전트는 954, 추론·지식은 1077(51위)다. 멀티모달과 과학·보안은 자료 없음이다.
벤치마크 해석
LLM Stats 집계에서 LiveCodeBench 91.6%(2/13), MathArena Apex 85.7%(2/11), HMMT Feb 26 94.8%(3/13)다. SWE-bench Verified는 79%(17/58), SWE-bench Pro는 52.6%(45/55)다. 모든 점수는 미검증이다.
선택 시 확인점
CorpusQA 1M은 60.5%(2/3), MRCR 1M은 78.7%(2/3)다. 장문 컨텍스트 활용 판단에는 참고할 수 있지만 측정 모델 수와 미검증 상태를 함께 봐야 한다. 같은 공급사에는 더 최근 출시 모델도 있다.
수집된 벤치·가격·출시 숫자만 입력으로 받아 LLM이 작성했고, 입력에 없는 숫자가 나오면 폐기합니다. 사용 결정은 원문 출처와 직접 평가로 확인하세요.
분야별 레이팅
비슷한 모델과 비교 →| 분야 | 레이팅 | 분야 순위 | 벤치 수 |
|---|---|---|---|
| 코딩 | 73 | 7 | |
| 에이전트 | 70 | 3 | |
| 추론·지식 | 80 | 9 | |
| 멀티모달 | — | — | — |
| 과학·보안 | — | — | — |
차트를 불러오는 중입니다…
분야 레이팅은 그 분야 벤치에서의 비교만으로 계산합니다. 회색 선은 종합 1위 모델입니다.
벤치마크 점수
19개 · 프로필별 순위코딩
| 벤치 | 프로필 | 점수 | 순위 | 백분위 | 출처 |
|---|---|---|---|---|---|
| SWE-bench Verified | LLM Stats 집계 | 79% | 17 / 58 | 72 | 자기보고 ↗ |
| SWE-bench Pro | LLM Stats 집계 | 52.6% | 45 / 55 | 19 | 자기보고 ↗ |
| Terminal-Bench 2.0 | LLM Stats 집계 | 56.9% | 23 / 40 | 44 | 자기보고 ↗ |
| SWE-bench Multilingual | LLM Stats 집계 | 73.3% | 18 / 35 | 50 | 자기보고 ↗ |
| IMO-AnswerBench | LLM Stats 집계 | 88.4% | 6 / 18 | 71 | 자기보고 ↗ |
| LiveCodeBench | LLM Stats 집계 | 91.6% | 2 / 13 | 92 | 자기보고 ↗ |
| CodeForces | LLM Stats 집계 | 1.0 | 3 / 10 | 72 | 자기보고 ↗ |
에이전트
| 벤치 | 프로필 | 점수 | 순위 | 백분위 | 출처 |
|---|---|---|---|---|---|
| BrowseComp | LLM Stats 집계 | 73.2% | 28 / 47 | 41 | 자기보고 ↗ |
| Toolathlon | LLM Stats 집계 | 47.8% | 28 / 38 | 27 | 자기보고 ↗ |
| MCP Atlas · Public | LLM Stats 집계 | 69% | 23 / 36 | 37 | 자기보고 ↗ |
추론·지식
| 벤치 | 프로필 | 점수 | 순위 | 백분위 | 출처 |
|---|---|---|---|---|---|
| GPQA Diamond | LLM Stats 집계 | 88.1% | 36 / 90 | 61 | 자기보고 ↗ |
| Humanity's Last Exam | LLM Stats 집계 | 45.1% | 29 / 64 | 56 | 자기보고 ↗ |
| MMLU-Pro | LLM Stats 집계 | 86.2% | 13 / 60 | 79 | 자기보고 ↗ |
| HMMT Feb 26 | LLM Stats 집계 | 94.8% | 3 / 13 | 83 | 자기보고 ↗ |
| SimpleQA | LLM Stats 집계 | 34.1% | 9 / 12 | 27 | 자기보고 ↗ |
| MathArena Apex | LLM Stats 집계 | 85.7% | 2 / 11 | 90 | 자기보고 ↗ |
| CSimpleQA | LLM Stats 집계 | 78.9% | 3 / 4 | 33 | 자기보고 ↗ |
| CorpusQA 1M | LLM Stats 집계 | 60.5% | 2 / 3 | 50 | 자기보고 ↗ |
| MRCR 1M | LLM Stats 집계 | 78.7% | 2 / 3 | 50 | 자기보고 ↗ |
순위는 같은 프로필(같은 문항·하네스·출처)에서 측정된 모델 중 위치입니다. * 는 자기보고·인용 등 검증되지 않은 값입니다.
레이팅이 비슷한 모델
- GLM-5.1 77위 · 1104 비교
- MiMo-V2.5-Pro 78위 · 1098 비교
- Nex-N2-Pro 79위 · 1094 비교
- Gemini 3 Pro 81위 · 1085 비교
- Ornith-1.5-35B-A3B 82위 · 1081 비교
- GLM-5 83위 · 1081 비교
DeepSeek의 다른 모델
공급사 →- DeepSeek-V4.1-Flash 2026-09-10 · 1386
- DeepSeek-V4-Flash-Vision-Exp 2026-08-31 · 1218
- DeepSeek-V4-Pro-0813 2026-08-13 · 1357
- DeepSeek-V4-Flash-0731 2026-07-31 · 1190
- DeepSeek-V4-Flash-DSpark 2026-06-27
- DeepSeek-V4-Flash-0423 2026-04-23 · 982
- DeepSeek-V4-Pro-Max 2026-04-23 · 1210
- DeepSeek-V4-Pro 2026-04-22 · 1162