Meta · 모델

Muse Spark 1.3

API출시 2026년 9월 2일LLMStats/muse-spark-1.3공식 문서 ↗
종합 레이팅1385 · 9위가중 비교 5 · 근거 적음
컨텍스트 창1.0M
가격 (입력 / 출력, 1M 토큰)$0.100 / $0.200혼합 $0.125
파라미터—
라이선스—
벤치 점수11개코딩·에이전트·추론·지식
분야레이팅분야 순위비교 수
코딩1167—1.5
에이전트1100172
추론·지식1221—1.5
멀티모달———
과학·보안———
차트를 불러오는 중입니다…

분야 레이팅은 그 분야 벤치에서의 비교만으로 계산합니다. 회색 선은 종합 1위 모델입니다.

벤치마크 점수

11개 · 프로필별 순위

코딩

벤치프로필점수순위백분위출처
Terminal-Bench 2.1LLM Stats 집계88.8%5 / 4392자기보고 ↗
DeepSWE 1.1LLM Stats 집계75.4%1 / 39100자기보고 ↗
SWE Atlas - Codebase QnALLM Stats 집계59.4%2 / 588자기보고 ↗

에이전트

벤치프로필점수순위백분위출처
AutomationBenchLLM Stats 집계49.4%5 / 2483자기보고 ↗
OSWorld 2.0LLM Stats 집계66.9%5 / 1469자기보고 ↗
DeepSearch QALLM Stats 집계89.4%6 / 1150자기보고 ↗
GDPval-AALLM Stats 집계1,7544 / 1170자기보고 ↗
Agentic IF Index (Internal)LLM Stats 집계57.8%1 / 150자기보고 ↗

추론·지식

벤치프로필점수순위백분위출처
MRCR v2 (8-needle)LLM Stats 집계98.5%1 / 22100자기보고 ↗
Job BenchLLM Stats 집계64.9%1 / 8100자기보고 ↗
MRCR v2 (8-needle, 512K-1M)LLM Stats 집계98.1%1 / 4100자기보고 ↗

순위는 같은 프로필(같은 문항·하네스·출처)에서 측정된 모델 중 위치입니다. * 는 자기보고·인용 등 검증되지 않은 값입니다.

레이팅이 비슷한 모델

Meta의 다른 모델

공급사 →