Moonshot AI (Kimi) · 모델

Kimi-K2.6

오픈이미지 입력출시 2026년 4월 14일moonshotai/Kimi-K2.6Hugging Face ↗
종합 레이팅1175 · 36위가중 비교 23.4
컨텍스트 창—
가격 (입력 / 출력, 1M 토큰)오픈 웨이트
파라미터1.0TKimiK25ForConditionalGeneration
라이선스other
최근 30일 다운로드446.1K좋아요 1.6K · 7일 -22.8K
벤치 점수40개코딩·에이전트·추론·지식·멀티모달

AI AI 해설

2026년 10월 9일 생성

추론·지식이 강점인 오픈 웨이트 모델, 코딩·에이전트는 상대적으로 낮음

종합 평가

종합 레이팅은 1154(17위), 가중 비교는 11.4다. 비슷한 레이팅 모델로 MiniMax-M3 1161(15위), GPT-5.6 Terra 1156(16위), DeepSeek-V4-Pro 1141(18위), Inkling-Small 1138(19위)이 제시됐다.

분야별 특성

추론·지식은 1185(3위)로 가장 두드러진다. 코딩은 1088(19위), 에이전트는 987(13위), 멀티모달은 1086이다. 과학·보안은 자료 없음이다.

주요 벤치 결과

HF 리더보드에서 GPQA Diamond 90.5%, SWE-bench Verified 80.2%, Terminal-Bench 2.0 66.7%, SWE-bench Multilingual 76.7%, HMMT February 2026 92.7%, MMMU-Pro 79.4%를 기록했다. Long-Horizon Terminal Bench는 0.0(미검증)이다.

도입 전 확인사항

컨텍스트, 최대 출력, 입력·출력 가격은 자료 없음이며 라이선스는 other로 표기됐다. AIME 2026은 LLM Stats 집계와 HF 리더보드에서 모두 96.4%지만 검증 여부와 순위가 다르므로 프로필별로 해석해야 한다.

수집된 벤치·가격·출시 숫자만 입력으로 받아 LLM이 작성했고, 입력에 없는 숫자가 나오면 폐기합니다. 사용 결정은 원문 출처와 직접 평가로 확인하세요.

분야레이팅분야 순위비교 수
코딩1086348.1
에이전트1014365
추론·지식1201167.4
멀티모달1129112.9
과학·보안———
차트를 불러오는 중입니다…

분야 레이팅은 그 분야 벤치에서의 비교만으로 계산합니다. 회색 선은 종합 1위 모델입니다.

벤치마크 점수

40개 · 프로필별 순위

코딩

벤치프로필점수순위백분위출처
SWE-bench ProPublic 73158.6%28 / 6356확인됨 ↗
SWE-bench VerifiedLLM Stats 집계80.2%14 / 5878자기보고 ↗
SWE-bench ProLLM Stats 집계58.6%26 / 5555자기보고 ↗
SWE-bench VerifiedHF 리더보드80.2%8 / 5388확인됨 ↗
LiveCodeBench v6LLM Stats 집계89.6%6 / 5189자기보고 ↗
Terminal-Bench 2.0LLM Stats 집계66.7%14 / 4067자기보고 ↗
SWE-bench MultilingualLLM Stats 집계76.7%13 / 3565자기보고 ↗
Terminal-Bench 2.0HF 리더보드66.7%6 / 3284확인됨 ↗
SWE-bench MultilingualHF 리더보드76.7%5 / 2684확인됨 ↗
SciCodeLLM Stats 집계52.2%6 / 2680자기보고 ↗
IMO-AnswerBenchLLM Stats 집계86%7 / 1862자기보고 ↗
FrontierSWELLM Stats 집계27%15 / 1713인용 ↗
Long-Horizon Terminal BenchHF 리더보드0.09 / 90인용 ↗

에이전트

벤치프로필점수순위백분위출처
BrowseCompLLM Stats 집계86.3%8 / 4785자기보고 ↗
ToolathlonLLM Stats 집계50%22 / 3843자기보고 ↗
OSWorld-VerifiedLLM Stats 집계73.1%17 / 2636자기보고 ↗
Claw-EvalHF 리더보드61.5%14 / 2135인용 ↗
Finance Agent v2LLM Stats 집계44.9%13 / 2140인용 ↗
SkillsBenchHF 리더보드54%4 / 1170인용 ↗
DeepSearch QALLM Stats 집계83%8 / 1130자기보고 ↗
Claw-EvalLLM Stats 집계80.9%1 / 10100자기보고 ↗
APEX-AgentsLLM Stats 집계27.9%6 / 829자기보고 ↗
MCP-MarkLLM Stats 집계55.9%4 / 857자기보고 ↗

추론·지식

벤치프로필점수순위백분위출처
GPQA DiamondLLM Stats 집계90.5%23 / 9075자기보고 ↗
GPQA DiamondHF 리더보드90.5%11 / 7086확인됨 ↗
Humanity's Last ExamLLM Stats 집계36.4%38 / 6441자기보고 ↗
Humanity's Last ExamHF 리더보드34.7%12 / 4877확인됨 ↗
AIME 2026LLM Stats 집계96.4%4 / 2688자기보고 ↗
AIME 2026HF 리더보드96.4%5 / 2483확인됨 ↗
LiveBenchLLM Stats 집계72.2%17 / 2327인용 ↗
HMMT February 2026HF 리더보드92.7%2 / 1994확인됨 ↗
WideSearchLLM Stats 집계80.8%4 / 1579자기보고 ↗
HMMT Feb 26LLM Stats 집계92.7%5 / 1367자기보고 ↗
V*LLM Stats 집계96.9%1 / 690자기보고 ↗
OJBenchLLM Stats 집계60.6%1 / 5100자기보고 ↗

멀티모달

벤치프로필점수순위백분위출처
MMMU-ProLLM Stats 집계80.1%14 / 6178자기보고 ↗
CharXiv-RLLM Stats 집계86.7%13 / 4874자기보고 ↗
MathVisionLLM Stats 집계93.2%6 / 3485자기보고 ↗
BabyVisionLLM Stats 집계68.5%7 / 1350자기보고 ↗
MMMU-ProHF 리더보드79.4%2 / 1089확인됨 ↗

순위는 같은 프로필(같은 문항·하네스·출처)에서 측정된 모델 중 위치입니다. * 는 자기보고·인용 등 검증되지 않은 값입니다.

Hugging Face 다운로드 추이

30일 변화 -83.9K (-15.8%)
차트를 불러오는 중입니다…

Hugging Face가 제공하는 최근 30일 다운로드 집계를 매일 기록한 값입니다(누적 다운로드가 아님).

레이팅이 비슷한 모델

Moonshot AI (Kimi)의 다른 모델

공급사 →