Inception · 모델

Mercury 2

API출시 2026년 2월 24일LLMStats/mercury-2공식 문서 ↗
종합 레이팅813 · 167위레이팅 벤치 19개
컨텍스트 창128K
가격 (입력 / 출력, 1M 토큰)$0.250 / $0.750혼합 $0.375
파라미터—
라이선스—
벤치 점수21개코딩·에이전트·추론·지식·과학·보안·속도·비용
분야레이팅분야 순위벤치 수
코딩8581565
에이전트904—1
추론·지식88114611
멀티모달———
과학·보안9181062
차트를 불러오는 중입니다…

분야 레이팅은 그 분야 벤치에서의 비교만으로 계산합니다. 회색 선은 종합 1위 모델입니다.

벤치마크 점수

21개 · 프로필별 순위

코딩

벤치프로필점수순위백분위출처
Terminal-Bench 2.1Artificial Analysis27.3%74 / 9724확인됨 ↗
Terminal-Bench HardArtificial Analysis26.5%51 / 9345확인됨 ↗
SciCodeArtificial Analysis37.7%75 / 8411확인됨 ↗
SciCodeLLM Stats 집계38%20 / 2626자기보고 ↗
LiveCodeBenchLLM Stats 집계67%12 / 138자기보고 ↗

에이전트

벤치프로필점수순위백분위출처
GDPval-AAArtificial Analysis0%98 / 10410확인됨 ↗

추론·지식

벤치프로필점수순위백분위출처
Humanity's Last ExamArtificial Analysis17.1%95 / 14133확인됨 ↗
Intelligence IndexArtificial Analysis13.8101 / 14129확인됨 ↗
AA-LCRArtificial Analysis43.7%113 / 13919확인됨 ↗
CritPTArtificial Analysis0.8%92 / 13934확인됨 ↗
GPQA DiamondArtificial Analysis77.0%92 / 13029확인됨 ↗
IFBenchArtificial Analysis69.8%37 / 9763확인됨 ↗
τ²-Bench TelecomArtificial Analysis70.8%59 / 9639확인됨 ↗
GPQA DiamondLLM Stats 집계74%74 / 9018자기보고 ↗
IFBenchLLM Stats 집계71%25 / 4241자기보고 ↗
AIME 2025LLM Stats 집계91.1%17 / 4059자기보고 ↗
Tau2 AirlineLLM Stats 집계53%7 / 814자기보고 ↗

과학·보안

벤치프로필점수순위백분위출처
AA-Omniscience AccuracyArtificial Analysis21.2%89 / 13936확인됨 ↗
AA-Omniscience IndexArtificial Analysis-50.7112 / 13920확인됨 ↗

속도·비용

벤치프로필점수순위백분위출처
Artificial Analysis Output SpeedArtificial Analysis428 tok/s2 / 10899확인됨 ↗
Artificial Analysis Time to First ChunkArtificial Analysis6.51초73 / 10833확인됨 ↗

순위는 같은 프로필(같은 문항·하네스·출처)에서 측정된 모델 중 위치입니다. * 는 자기보고·인용 등 검증되지 않은 값입니다.

레이팅이 비슷한 모델