Skip to main content
leaderboard
.cn
Toggle Sidebar
Search models or organizations…
⌘K
Explore
Frontier Models
Historical Trends
Local Models
Compare Models
Ranking Studio
Library
Models
Pricing
Organizations
Benchmarks
Data sources
Settings
Toggle Sidebar
leaderboard
.cn
Loading page content
Feedback
Loading page content
Back to models
Muse Spark
Closed
Share
Add to comparison
Tool use · Reasoning
Overview
Evaluations
Evaluation overview
Overall rank
#52
79.5 points · 202 models
Research rank
#36
90.2 points · 196 models
Data coverage
18 items
4 sources · updated through 2026-09-02
Domain performance
Coding
#59 / 182
74
Research
#36 / 196
90.2
Agents
#63 / 148
72
Vision
#17 / 82
84.9
Long context
#37 / 95
80.1
Evaluation highlights
All evaluations
Arena Text Rating
Reasoning · Arena.ai Text
1,488.25Elo
11
/ 375
Arena Vision Rating
Multimodal · Arena.ai Vision
1,294.89Elo
6
/ 133
MCP-Atlas
Agents · Meta Muse Spark 1.1 Evaluation Report
82.2%
12
/ 46
Arena Document Rating
Long context · Arena.ai Document
1,444.91Elo
20
/ 33
SWE-bench Pro
Coding · Meta Muse Spark 1.1 Evaluation Report
55%
40
/ 55
CharXiv Reasoning (w/ tools)
Multimodal · Meta Muse Spark 1.1 Evaluation Report
88.9%
4
/ 12
Basic information
Context (input / output)
1M / -
Release date
2026-04
Input modalities
Text · Image · Video · Audio · PDF
Output modalities
Text
Version
1.0
Family
Muse Spark
Related links
Official site