Meta · 모델

Muse Spark 1.1

API출시 2026년 7월 9일LLMStats/muse-spark-1.1공식 문서 ↗
종합 레이팅1232 · 31위가중 비교 5.5 · 근거 적음
컨텍스트 창1.0M
가격 (입력 / 출력, 1M 토큰)$1.25 / $4.25혼합 $2.00
파라미터—
라이선스—
벤치 점수11개코딩·에이전트·추론·지식·멀티모달
분야레이팅분야 순위비교 수
코딩1012—1.5
에이전트1147112
추론·지식1089—1
멀티모달1084—1
과학·보안———
차트를 불러오는 중입니다…

분야 레이팅은 그 분야 벤치에서의 비교만으로 계산합니다. 회색 선은 종합 1위 모델입니다.

벤치마크 점수

11개 · 프로필별 순위

코딩

벤치프로필점수순위백분위출처
SWE-bench ProLLM Stats 집계61.5%19 / 5567자기보고 ↗
Terminal-Bench 2.1LLM Stats 집계80%23 / 4348자기보고 ↗
DeepSWE 1.1LLM Stats 집계53%30 / 3924인용 ↗

에이전트

벤치프로필점수순위백분위출처
ToolathlonLLM Stats 집계75.6%2 / 3897자기보고 ↗
MCP Atlas · PublicLLM Stats 집계88.1%1 / 36100자기보고 ↗
OSWorld-VerifiedLLM Stats 집계80.8%9 / 2670자기보고 ↗
Finance Agent v2LLM Stats 집계57.2%3 / 2190자기보고 ↗

추론·지식

벤치프로필점수순위백분위출처
Humanity's Last ExamLLM Stats 집계62.1%6 / 6492자기보고 ↗
Job BenchLLM Stats 집계54.7%5 / 843자기보고 ↗

멀티모달

벤치프로필점수순위백분위출처
CharXiv-RLLM Stats 집계88.4%11 / 4879자기보고 ↗
BabyVisionLLM Stats 집계76.3%4 / 1375자기보고 ↗

순위는 같은 프로필(같은 문항·하네스·출처)에서 측정된 모델 중 위치입니다. * 는 자기보고·인용 등 검증되지 않은 값입니다.

레이팅이 비슷한 모델

Meta의 다른 모델

공급사 →