MiniMax · 모델

MiniMax-M2.5

오픈출시 2026년 2월 12일MiniMaxAI/MiniMax-M2.5Hugging Face ↗
종합 레이팅965 · 123위레이팅 벤치 17개
컨텍스트 창—
가격 (입력 / 출력, 1M 토큰)오픈 웨이트
파라미터229BMiniMaxM2ForCausalLM
라이선스other
최근 30일 다운로드532.9K좋아요 1.5K · 7일 +162.0K
벤치 점수19개코딩·에이전트·추론·지식·과학·보안·속도·비용

AI AI 해설

2026년 10월 9일 생성

코딩·에이전트 중심의 오픈 웨이트 모델, 종합 레이팅 910

종합 평가

MiniMax-M2.5의 종합 레이팅은 910(49위), 가중 비교는 4.7이다. 비슷한 모델로 GPT-5.3-Codex 922(47위), MiniMax-M2.1 914(48위), Ornith-1.5-9B 887(50위), Gemini 3.6 Flash 872(51위)가 있다.

분야별 성능

분야 레이팅은 코딩 986, 추론·지식 927(40위), 에이전트 917이다. 멀티모달과 과학·보안은 자료 없음이다.

벤치 결과

GPQA Diamond 85.2%(41/70), SWE-bench Pro 55.4%(40/63), Humanity's Last Exam 19.4%(38/48)다. MMLU-Pro 80.1%, SWE-bench Verified 75.8%, WildClawBench 27.1%, APEX Agents 6.2%는 미검증이다.

도입 시 확인사항

오픈 웨이트이며 라이선스는 other다. 컨텍스트, 최대 출력, 입력·출력 가격은 자료 없음이다. 같은 공급사의 최신 모델로 MiniMax-M3(2026-06-02), MiniMax-M2.7(2026-04-09)이 제시돼 있다.

수집된 벤치·가격·출시 숫자만 입력으로 받아 LLM이 작성했고, 입력에 없는 숫자가 나오면 폐기합니다. 사용 결정은 원문 출처와 직접 평가로 확인하세요.

분야레이팅분야 순위벤치 수
코딩1004873
에이전트915912
추론·지식98911510
멀티모달———
과학·보안959872
차트를 불러오는 중입니다…

분야 레이팅은 그 분야 벤치에서의 비교만으로 계산합니다. 회색 선은 종합 1위 모델입니다.

벤치마크 점수

19개 · 프로필별 순위

코딩

벤치프로필점수순위백분위출처
Terminal-Bench HardArtificial Analysis34.8%37 / 9360확인됨 ↗
SWE-bench ProPublic 73155.4%40 / 6338확인됨 ↗
SWE-bench VerifiedHF 리더보드75.8%20 / 5363인용 ↗

에이전트

벤치프로필점수순위백분위출처
WildClawBenchHF 리더보드27.1%21 / 225인용 ↗
APEX AgentsHF 리더보드6.2%10 / 1325인용 ↗

추론·지식

벤치프로필점수순위백분위출처
Humanity's Last ExamArtificial Analysis20.5%89 / 14137확인됨 ↗
Intelligence IndexArtificial Analysis22.871 / 14150확인됨 ↗
AA-LCRArtificial Analysis73.3%75 / 13947확인됨 ↗
CritPTArtificial Analysis1.1%85 / 13939확인됨 ↗
GPQA DiamondArtificial Analysis84.8%67 / 13049확인됨 ↗
IFBenchArtificial Analysis71.6%31 / 9769확인됨 ↗
τ²-Bench TelecomArtificial Analysis95.3%13 / 9687확인됨 ↗
GPQA DiamondHF 리더보드85.2%41 / 7042확인됨 ↗
MMLU-ProHF 리더보드80.1%36 / 5333인용 ↗
Humanity's Last ExamHF 리더보드19.4%38 / 4821확인됨 ↗

과학·보안

벤치프로필점수순위백분위출처
AA-Omniscience AccuracyArtificial Analysis26.2%70 / 13950확인됨 ↗
AA-Omniscience IndexArtificial Analysis-38.9100 / 13928확인됨 ↗

속도·비용

벤치프로필점수순위백분위출처
Artificial Analysis Output SpeedArtificial Analysis91 tok/s50 / 10854확인됨 ↗
Artificial Analysis Time to First ChunkArtificial Analysis1.42초16 / 10886확인됨 ↗

순위는 같은 프로필(같은 문항·하네스·출처)에서 측정된 모델 중 위치입니다. * 는 자기보고·인용 등 검증되지 않은 값입니다.

Hugging Face 다운로드 추이

30일 변화 +179.2K (+50.7%)
차트를 불러오는 중입니다…

Hugging Face가 제공하는 최근 30일 다운로드 집계를 매일 기록한 값입니다(누적 다운로드가 아님).

레이팅이 비슷한 모델

MiniMax의 다른 모델

공급사 →