Alibaba (Qwen) · 모델

Qwen3.8-2.4T-A95B

오픈출시 2026년 8월 8일Qwen/Qwen3.8-2.4T-A95BHugging Face ↗
종합 레이팅1245 · 26위가중 비교 5.2 · 근거 적음
컨텍스트 창—
가격 (입력 / 출력, 1M 토큰)오픈 웨이트
파라미터2.4TQwen3_5MoeForCausalLM
라이선스other
최근 30일 다운로드33.2K좋아요 1.3K · 7일 -7.0K
벤치 점수6개코딩·에이전트·추론·지식

AI AI 해설

2026년 10월 9일 생성

종합 레이팅 1220(10위)의 오픈 웨이트 모델로 추론·에이전트 벤치가 고르게 제시됐다

종합 평가

종합 레이팅은 1220(10위), 가중 비교는 5.2다. 분야 레이팅은 추론·지식 1167, 코딩 1114(14위), 에이전트 1061이다. 레이팅은 같은 벤치 비교에 기반한 상대 지표다.

벤치 결과

HF 리더보드에서 GPQA Diamond 92.6%(5/70), Humanity's Last Exam 43.6%(5/48), Terminal-Bench 2.1 86.6%(6/28), DeepSWE 56.6%(13/21)다. SWE-bench Pro는 Public 731 프로필에서 67.7%(7/63)다.

검증과 자료 공백

WildClawBench는 HF 리더보드 기준 56.2%(미검증), 2/22다. 멀티모달과 과학·보안은 자료 없음이다. 컨텍스트, 최대 출력, 입력·출력 가격도 자료 없음이며 라이선스는 other로 표시됐다.

비슷한 레이팅

비슷한 모델의 종합 레이팅은 Qwen3.8-Flash-Next 1224(9위), Claude Opus 5 1206(11위), Gemini 3.7 Flash 1195(12위), Ornith-1.5-397B 1255(8위)다.

수집된 벤치·가격·출시 숫자만 입력으로 받아 LLM이 작성했고, 입력에 없는 숫자가 나오면 폐기합니다. 사용 결정은 원문 출처와 직접 평가로 확인하세요.

분야레이팅분야 순위비교 수
코딩1122222.9
에이전트1060—0.5
추론·지식1175—1.8
멀티모달———
과학·보안———
차트를 불러오는 중입니다…

분야 레이팅은 그 분야 벤치에서의 비교만으로 계산합니다. 회색 선은 종합 1위 모델입니다.

벤치마크 점수

6개 · 프로필별 순위

코딩

벤치프로필점수순위백분위출처
SWE-bench ProPublic 73167.7%7 / 6390확인됨 ↗
Terminal-Bench 2.1HF 리더보드86.6%6 / 2881확인됨 ↗
DeepSWEHF 리더보드56.6%13 / 2140확인됨 ↗

에이전트

벤치프로필점수순위백분위출처
WildClawBenchHF 리더보드56.2%2 / 2295인용 ↗

추론·지식

벤치프로필점수순위백분위출처
GPQA DiamondHF 리더보드92.6%5 / 7094확인됨 ↗
Humanity's Last ExamHF 리더보드43.6%5 / 4891확인됨 ↗

순위는 같은 프로필(같은 문항·하네스·출처)에서 측정된 모델 중 위치입니다. * 는 자기보고·인용 등 검증되지 않은 값입니다.

Hugging Face 다운로드 추이

30일 변화 -18.5K (-35.8%)
차트를 불러오는 중입니다…

Hugging Face가 제공하는 최근 30일 다운로드 집계를 매일 기록한 값입니다(누적 다운로드가 아님).

레이팅이 비슷한 모델

Alibaba (Qwen)의 다른 모델

공급사 →

관련 소식

euno.news 패밀리 기사