dots3-note-prev
AI AI 해설
2026년 10월 9일 생성에이전트 분야가 강점인 아파치-2.0 오픈 웨이트 모델
종합 평가
종합 레이팅은 1113(20위), 가중 비교는 7.1이다. 비슷한 레이팅의 모델로 DeepSeek-V4-Pro 1141(18위), Inkling-Small 1138(19위), Hy3 1112(21위), Inkling 1098(22위)가 있다.
에이전트 성능
에이전트 레이팅은 1110(5위)이다. HF 리더보드에서 WildClawBench 61.7%(1/22), Claw-Eval 73.4%(4/21), APEX Agents 30.8%(3/13), SkillsBench 52.8%(6/11)를 기록했다.
코딩과 멀티모달
코딩 레이팅은 1067(23위)이다. SWE-bench Pro Public 731은 61%(21/63), HF 리더보드의 SWE-bench Verified는 78.4%(12/53), Terminal-Bench 2.1은 75.1%(15/28), SWE-bench Multilingual은 75.7%(9/26)다. 멀티모달 레이팅은 931이며 Video-MME v2는 39.3%(4/4)다.
도입 시 확인사항
apache-2.0 라이선스의 오픈 웨이트 모델이다. 컨텍스트, 최대 출력, 입력·출력 가격은 자료 없음이다. 추론·지식과 과학·보안도 자료 없음이며, 같은 공급사의 최신 모델은 없다.
수집된 벤치·가격·출시 숫자만 입력으로 받아 LLM이 작성했고, 입력에 없는 숫자가 나오면 폐기합니다. 사용 결정은 원문 출처와 직접 평가로 확인하세요.
분야별 레이팅
비슷한 모델과 비교 →| 분야 | 레이팅 | 분야 순위 | 벤치 수 |
|---|---|---|---|
| 코딩 | 57 | 4 | |
| 에이전트 | 25 | 4 | |
| 추론·지식 | — | — | — |
| 멀티모달 | — | 1 | |
| 과학·보안 | — | — | — |
분야 레이팅은 그 분야 벤치에서의 비교만으로 계산합니다. 회색 선은 종합 1위 모델입니다.
벤치마크 점수
9개 · 프로필별 순위코딩
| 벤치 | 프로필 | 점수 | 순위 | 백분위 | 출처 |
|---|---|---|---|---|---|
| SWE-bench Pro | Public 731 | 61% | 21 / 63 | 68 | 확인됨 ↗ |
| SWE-bench Verified | HF 리더보드 | 78.4% | 12 / 53 | 79 | 확인됨 ↗ |
| Terminal-Bench 2.1 | HF 리더보드 | 75.1% | 15 / 28 | 48 | 확인됨 ↗ |
| SWE-bench Multilingual | HF 리더보드 | 75.7% | 9 / 26 | 68 | 확인됨 ↗ |
에이전트
| 벤치 | 프로필 | 점수 | 순위 | 백분위 | 출처 |
|---|---|---|---|---|---|
| WildClawBench | HF 리더보드 | 61.7% | 1 / 22 | 100 | 확인됨 ↗ |
| Claw-Eval | HF 리더보드 | 73.4% | 4 / 21 | 85 | 확인됨 ↗ |
| APEX Agents | HF 리더보드 | 30.8% | 3 / 13 | 83 | 확인됨 ↗ |
| SkillsBench | HF 리더보드 | 52.8% | 6 / 11 | 50 | 확인됨 ↗ |
멀티모달
| 벤치 | 프로필 | 점수 | 순위 | 백분위 | 출처 |
|---|---|---|---|---|---|
| Video-MME v2 | HF 리더보드 | 39.3% | 4 / 4 | 0 | 확인됨 ↗ |
순위는 같은 프로필(같은 문항·하네스·출처)에서 측정된 모델 중 위치입니다. * 는 자기보고·인용 등 검증되지 않은 값입니다.
Hugging Face 다운로드 추이
30일 변화 -358 (-26.3%)Hugging Face가 제공하는 최근 30일 다운로드 집계를 매일 기록한 값입니다(누적 다운로드가 아님).
레이팅이 비슷한 모델
- DeepSeek-V4-Pro 65위 · 1162 비교
- Qwen3.7-Plus 66위 · 1162 비교
- Hy3 67위 · 1153 비교
- Claude Sonnet 4.6 69위 · 1144 비교
- Kimi-K2.7-Code 70위 · 1142 비교
- Qwen3.6 Plus 71위 · 1127 비교