Skip to main content
leaderboard
.cn
Toggle Sidebar
Search models or organizations…
⌘K
Explore
Frontier Models
Historical Trends
Local Models
Compare Models
Ranking Studio
Library
Models
Pricing
Organizations
Benchmarks
Data sources
Settings
Toggle Sidebar
leaderboard
.cn
Loading page content
Feedback
Loading page content
Back to models
Muse Spark
Closed
Share
Add to comparison
Tool use · Reasoning
Overview
Evaluations
Evaluation overview
Overall rank
#30
80.5 points · 180 models
Research rank
#23
91.1 points · 174 models
Data coverage
18 items
4 sources · updated through 2026-07-16
Domain performance
Coding
#41 / 160
77.7
Research
#23 / 174
91.1
Agents
#39 / 125
76.2
Vision
#14 / 65
89.5
Long context
#18 / 82
83.1
Evaluation highlights
All evaluations
Arena Text Rating
Reasoning · Arena.ai Text
1,487.58Elo
5
/ 354
Arena Vision Rating
Multimodal · Arena.ai Vision
1,294.89Elo
4
/ 121
MCP-Atlas
Agents · Meta Muse Spark 1.1 Evaluation Report
82.2%
9
/ 40
Arena Document Rating
Long context · Arena.ai Document
1,444.91Elo
13
/ 28
SWE-bench Pro
Coding · Meta Muse Spark 1.1 Evaluation Report
55%
33
/ 46
CharXiv Reasoning (w/ tools)
Multimodal · Meta Muse Spark 1.1 Evaluation Report
88.9%
2
/ 5
Basic information
Context (input / output)
1M / -
Release date
2026-04
Input modalities
Text · Image · Video · Audio · pdf
Output modalities
Text
Version
1.0
Related links
Official site