Anthropic · 모델

Claude Mythos Preview

API출시 2026년 5월 28일Anthropic/claude-mythos-preview공식 문서 ↗
종합 레이팅1357 · 11위가중 비교 9.5
컨텍스트 창—
가격 (입력 / 출력, 1M 토큰)—
파라미터—
라이선스commercial API
벤치 점수22개코딩·에이전트·추론·지식·멀티모달·과학·보안
분야레이팅분야 순위비교 수
코딩1201122.5
에이전트1063242.5
추론·지식1215122.5
멀티모달1114—1
과학·보안1048—1
차트를 불러오는 중입니다…

분야 레이팅은 그 분야 벤치에서의 비교만으로 계산합니다. 회색 선은 종합 1위 모델입니다.

벤치마크 점수

22개 · 프로필별 순위

코딩

벤치프로필점수순위백분위출처
SWE-bench ProPublic 73177.8%5 / 6394인용 ↗
SWE-bench VerifiedLLM Stats 집계93.9%2 / 5898자기보고 ↗
SWE-bench ProLLM Stats 집계77.8%4 / 5594자기보고 ↗
Terminal-Bench 2.0LLM Stats 집계82%2 / 4097자기보고 ↗
SWE-bench MultilingualLLM Stats 집계87.3%3 / 3594자기보고 ↗

에이전트

벤치프로필점수순위백분위출처
BrowseCompLLM Stats 집계86.9%7 / 4787자기보고 ↗
OSWorld-VerifiedLLM Stats 집계79.6%10 / 2664자기보고 ↗
ToolathlonOpenAI 공개 평가61.1%3 / 975인용 ↗
BrowseCompOpenAI 공개 평가87.9%3 / 871인용 ↗
BenchCADOpenAI 공개 평가35.5%6 / 717인용 ↗

추론·지식

벤치프로필점수순위백분위출처
GPQA DiamondLLM Stats 집계94.6%2 / 9098자기보고 ↗
Humanity's Last ExamLLM Stats 집계64.7%2 / 6498자기보고 ↗
MMMLULLM Stats 집계92.7%1 / 30100자기보고 ↗
Graphwalks BFS >128kLLM Stats 집계80%5 / 1264자기보고 ↗
GPQA DiamondOpenAI 공개 평가94.6%1 / 994인용 ↗
CyBenchLLM Stats 집계100%1 / 2100자기보고 ↗
FigQALLM Stats 집계89%1 / 2100자기보고 ↗
USAMO25LLM Stats 집계97.6%1 / 150자기보고 ↗

멀티모달

벤치프로필점수순위백분위출처
CharXiv-RLLM Stats 집계93.2%1 / 48100자기보고 ↗
SWE-Bench MultimodalLLM Stats 집계59%2 / 783자기보고 ↗

과학·보안

벤치프로필점수순위백분위출처
CyberGymLLM Stats 집계83.1%8 / 1961자기보고 ↗
ExploitBenchOpenAI 공개 평가74.2%2 / 783인용 ↗

순위는 같은 프로필(같은 문항·하네스·출처)에서 측정된 모델 중 위치입니다. * 는 자기보고·인용 등 검증되지 않은 값입니다.

레이팅이 비슷한 모델

Anthropic의 다른 모델

공급사 →