MiniMax · 모델

MiniMax-M3

오픈이미지 입력출시 2026년 6월 2일MiniMaxAI/MiniMax-M3Hugging Face ↗
종합 레이팅1187 · 60위레이팅 벤치 45개
컨텍스트 창—
가격 (입력 / 출력, 1M 토큰)오픈 웨이트
파라미터427BMiniMaxM3SparseForConditionalGeneration
라이선스other
최근 30일 다운로드205.1K좋아요 1.6K · 7일 +36.2K
벤치 점수58개코딩·에이전트·추론·지식·멀티모달·과학·보안·속도·비용

AI AI 해설

2026년 10월 9일 생성

에이전트·멀티모달 강점이 보이지만 핵심 사양과 일부 검증 자료는 부족

종합 평가

종합 레이팅 1161(15위), 가중 비교 6.8이다. 비슷한 레이팅의 Qwen3.8-27B 1162(14위), GPT-5.6 Terra 1156(16위) 등이 있어 상대적 위치를 함께 살필 수 있다.

분야별 특징

에이전트 1061(8위), 코딩 1076(22위), 멀티모달 1136이다. 추론·지식과 과학·보안은 자료 없음으로, 해당 업무 적합성을 이 자료만으로 판단하기 어렵다.

벤치 결과

HF 리더보드에서 SWE-bench Verified 80.5%(6/53), Claw-Eval 74.5%(3/21), APEX Agents 27.7%(4/13)다. OmniDocBench 1.5는 91.6%(미검증, 1/20), Video-MME v2는 85.4%(1/4)다. 프로필이 달라 점수 간 직접 비교는 피해야 한다.

도입 확인사항

오픈 웨이트이며 라이선스는 other다. 컨텍스트, 최대 출력, 입력·출력 가격은 자료 없음이다. 미검증 표기가 있는 Terminal-Bench 2.1, MCP Atlas, OSWorld-Verified 등은 별도 검증이 필요하다.

수집된 벤치·가격·출시 숫자만 입력으로 받아 LLM이 작성했고, 입력에 없는 숫자가 나오면 폐기합니다. 사용 결정은 원문 출처와 직접 평가로 확인하세요.

분야레이팅분야 순위벤치 수
코딩10835612
에이전트10614010
추론·지식11575615
멀티모달1133176
과학·보안977772
차트를 불러오는 중입니다…

분야 레이팅은 그 분야 벤치에서의 비교만으로 계산합니다. 회색 선은 종합 1위 모델입니다.

벤치마크 점수

58개 · 프로필별 순위

코딩

벤치프로필점수순위백분위출처
Terminal-Bench 2.1Artificial Analysis65.2%37 / 9763확인됨 ↗
Terminal-Bench HardArtificial Analysis42.4%26 / 9373확인됨 ↗
SciCodeArtificial Analysis47.1%51 / 8440확인됨 ↗
SWE-bench ProPublic 73159%26 / 6360확인됨 ↗
SWE-bench VerifiedLLM Stats 집계80.5%11 / 5882자기보고 ↗
SWE-bench ProLLM Stats 집계59%23 / 5559자기보고 ↗
SWE-bench VerifiedHF 리더보드80.5%6 / 5390확인됨 ↗
Terminal-Bench 2.1LLM Stats 집계66%31 / 4329자기보고 ↗
FrontierCode 1.1LLM Stats 집계14.7%21 / 225인용 ↗
Long-Horizon Terminal BenchHF 리더보드3.04 / 975인용 ↗
PostTrainBenchLLM Stats 집계37.1%2 / 783자기보고 ↗
SWE Atlas - Codebase QnALLM Stats 집계37.9%5 / 50자기보고 ↗
KernelBench HardLLM Stats 집계28.8%1 / 150자기보고 ↗
SWE Atlas - Test WritingLLM Stats 집계30.8%1 / 150자기보고 ↗
SWE-fficiencyLLM Stats 집계34.8%1 / 150자기보고 ↗

에이전트

벤치프로필점수순위백분위출처
GDPval-AAArtificial Analysis37.1%39 / 10463확인됨 ↗
BrowseCompLLM Stats 집계83.5%17 / 4765자기보고 ↗
MCP Atlas · PublicLLM Stats 집계74.2%17 / 3654자기보고 ↗
OSWorld-VerifiedLLM Stats 집계70.1%19 / 2628자기보고 ↗
Claw-EvalHF 리더보드74.5%3 / 2190확인됨 ↗
Finance Agent v2LLM Stats 집계48.3%11 / 2150인용 ↗
APEX AgentsHF 리더보드27.7%4 / 1375확인됨 ↗
SkillsBenchHF 리더보드53%5 / 1160인용 ↗
Claw-EvalLLM Stats 집계74.5%2 / 1089자기보고 ↗
APEX-AgentsLLM Stats 집계27.7%7 / 814자기보고 ↗
GDPval-RubricsLLM Stats 집계74.8%1 / 150자기보고 ↗

추론·지식

벤치프로필점수순위백분위출처
Humanity's Last ExamArtificial Analysis39.0%41 / 14172확인됨 ↗
Intelligence IndexArtificial Analysis29.248 / 14166확인됨 ↗
AA-LCRArtificial Analysis83%17 / 13989확인됨 ↗
CritPTArtificial Analysis3.7%64 / 13954확인됨 ↗
GPQA DiamondArtificial Analysis92.9%12 / 13091확인됨 ↗
IFBenchArtificial Analysis82.9%1 / 97100확인됨 ↗
τ²-Bench TelecomArtificial Analysis88.9%36 / 9663확인됨 ↗
LiveBenchLLM Stats 집계70.0%22 / 235인용 ↗
NL2RepoLLM Stats 집계42.1%18 / 2219자기보고 ↗
OfficeQA ProLLM Stats 집계45.1%12 / 120자기보고 ↗
DRACOLLM Stats 집계73.2%3 / 433자기보고 ↗
CL-benchLLM Stats 집계20.5%2 / 350자기보고 ↗
PaperBenchLLM Stats 집계52.6%3 / 30자기보고 ↗
SpreadSheetBench-v1LLM Stats 집계89.4%1 / 3100자기보고 ↗
USAMO 2026LLM Stats 집계36.01 / 3100자기보고 ↗
BankerToolBenchLLM Stats 집계76.1%2 / 20자기보고 ↗
IMO 2025LLM Stats 집계35.01 / 2100자기보고 ↗
LiveSQLBenchLLM Stats 집계40.2%1 / 150자기보고 ↗
LOCA-Bench (256k)LLM Stats 집계49.3%1 / 150자기보고 ↗
SVG-BenchLLM Stats 집계63.7%1 / 150자기보고 ↗
VIBE-V2LLM Stats 집계50.1%1 / 150자기보고 ↗
YC-BenchLLM Stats 집계2,100,0001 / 150자기보고 ↗

멀티모달

벤치프로필점수순위백분위출처
MMMU-ProArtificial Analysis78.6%25 / 6965확인됨 ↗
MMMU-ProLLM Stats 집계78.1%20 / 6168자기보고 ↗
VideoMMMULLM Stats 집계84.6%6 / 2377자기보고 ↗
OmniDocBench 1.5LLM Stats 집계91.6%1 / 20100자기보고 ↗
Video-MMELLM Stats 집계85.4%5 / 1160자기보고 ↗
Video-MME v2HF 리더보드85.4%1 / 4100확인됨 ↗

과학·보안

벤치프로필점수순위백분위출처
AA-Omniscience AccuracyArtificial Analysis16.7%111 / 13920확인됨 ↗
AA-Omniscience IndexArtificial Analysis1.445 / 13968확인됨 ↗

속도·비용

벤치프로필점수순위백분위출처
Artificial Analysis Output SpeedArtificial Analysis92 tok/s47 / 10857확인됨 ↗
Artificial Analysis Time to First ChunkArtificial Analysis1.77초24 / 10879확인됨 ↗

순위는 같은 프로필(같은 문항·하네스·출처)에서 측정된 모델 중 위치입니다. * 는 자기보고·인용 등 검증되지 않은 값입니다.

Hugging Face 다운로드 추이

30일 변화 +13.5K (+7.0%)
차트를 불러오는 중입니다…

Hugging Face가 제공하는 최근 30일 다운로드 집계를 매일 기록한 값입니다(누적 다운로드가 아님).

레이팅이 비슷한 모델

MiniMax의 다른 모델

공급사 →