Thinking Machines · 모델

Inkling

오픈이미지 입력출시 2026년 7월 14일thinkingmachines/InklingHugging Face ↗
종합 레이팅1091 · 59위가중 비교 12.4
컨텍스트 창—
가격 (입력 / 출력, 1M 토큰)오픈 웨이트
파라미터952BInklingForConditionalGeneration
라이선스apache-2.0
최근 30일 다운로드947.0K좋아요 1.8K · 7일 +306.3K
벤치 점수22개코딩·에이전트·추론·지식·멀티모달·과학·보안

AI AI 해설

2026년 10월 9일 생성

추론·지식이 강점이며 코딩·에이전트 활용은 검증이 필요한 모델

종합 평가

종합 레이팅 1098(22위), 가중 비교 7.4다. 비슷한 모델은 dots3-note-prev 1113(20위), Hy3 1112(21위), GLM-5.1 1078(23위), Claude Opus 4.8 1076(24위)다.

분야별 특징

추론·지식은 1182(4위)로 두드러진다. 코딩은 956(44위), 에이전트는 1024다. 멀티모달과 과학·보안은 자료 없음이다.

벤치마크 근거

HF 리더보드에서 Humanity's Last Exam 46%(3/48), AIME 2026 97.1%(3/24), GPQA Diamond 87.2%(28/70), SWE-bench Verified 77.6%(15/53)다. LLM Stats 집계의 미검증 점수는 별도 확인이 필요하다.

도입 전 확인사항

오픈 웨이트이며 라이선스는 apache-2.0이다. 컨텍스트, 최대 출력, 입력·출력 가격은 자료 없음이다. 같은 공급사의 최신 모델은 Inkling-Small(2026-07-27)이므로 함께 검토할 수 있다.

수집된 벤치·가격·출시 숫자만 입력으로 받아 LLM이 작성했고, 입력에 없는 숫자가 나오면 폐기합니다. 사용 결정은 원문 출처와 직접 평가로 확인하세요.

분야레이팅분야 순위비교 수
코딩963683.8
에이전트995—1.5
추론·지식1174235.6
멀티모달987—1
과학·보안998—0.5
차트를 불러오는 중입니다…

분야 레이팅은 그 분야 벤치에서의 비교만으로 계산합니다. 회색 선은 종합 1위 모델입니다.

벤치마크 점수

22개 · 프로필별 순위

코딩

벤치프로필점수순위백분위출처
SWE-bench ProPublic 73154.3%42 / 6334확인됨 ↗
SWE-bench VerifiedLLM Stats 집계77.6%25 / 5857자기보고 ↗
SWE-bench VerifiedHF 리더보드77.6%15 / 5372확인됨 ↗
Terminal-Bench 2.1LLM Stats 집계63.8%33 / 4324자기보고 ↗
Terminal-Bench 2.1HF 리더보드63.8%21 / 2826확인됨 ↗

에이전트

벤치프로필점수순위백분위출처
MCP Atlas · PublicLLM Stats 집계76%13 / 3664자기보고 ↗
GDPval-AALLM Stats 집계1,23810 / 1110자기보고 ↗
Tau3 BankingLLM Stats 집계23.7%4 / 1067자기보고 ↗

추론·지식

벤치프로필점수순위백분위출처
GPQA DiamondHF 리더보드87.2%28 / 7062확인됨 ↗
Humanity's Last ExamHF 리더보드46%3 / 4896확인됨 ↗
IFBenchLLM Stats 집계79.8%8 / 4283자기보고 ↗
AIME 2026LLM Stats 집계97.1%2 / 2696자기보고 ↗
AIME 2026HF 리더보드97.1%3 / 2493확인됨 ↗
Humanity's Last Exam (no tools, text-only)LLM Stats 집계29.7%9 / 1120자기보고 ↗
Humanity's Last Exam (with tools, text-only)LLM Stats 집계46%9 / 1011자기보고 ↗
SimpleQA VerifiedLLM Stats 집계43.9%1 / 4100자기보고 ↗
MMAULLM Stats 집계77.2%1 / 3100자기보고 ↗
Global-MMLU-LiteLLM Stats 집계88.7%1 / 2100자기보고 ↗
VoiceBench AvgLLM Stats 집계91.4%1 / 2100자기보고 ↗

멀티모달

벤치프로필점수순위백분위출처
MMMU-ProLLM Stats 집계73.5%34 / 6145자기보고 ↗
CharXiv-RLLM Stats 집계78.1%28 / 4843자기보고 ↗

과학·보안

벤치프로필점수순위백분위출처
AA-Omniscience IndexLLM Stats 집계2.12 / 350자기보고 ↗

순위는 같은 프로필(같은 문항·하네스·출처)에서 측정된 모델 중 위치입니다. * 는 자기보고·인용 등 검증되지 않은 값입니다.

Hugging Face 다운로드 추이

30일 변화 +614.2K (+184.6%)
차트를 불러오는 중입니다…

Hugging Face가 제공하는 최근 30일 다운로드 집계를 매일 기록한 값입니다(누적 다운로드가 아님).

레이팅이 비슷한 모델

Thinking Machines의 다른 모델

공급사 →