Skip to main content
leaderboard
.cn
Toggle Sidebar
Search models or organizations…
⌘K
Explore
Frontier Models
Historical Trends
Local Models
Compare Models
Ranking Studio
Library
Models
Pricing
Organizations
Benchmarks
Data sources
Settings
Toggle Sidebar
leaderboard
.cn
Loading page content
Feedback
Loading page content
Back to models
Muse Spark 1.1
Closed
Share
Add to comparison
Tool use · Reasoning
Overview
Evaluations
Evaluation overview
Overall rank
#12
87.4 points · 180 models
Research rank
#9
96.1 points · 174 models
Data coverage
27 items
4 sources · updated through 2026-07-16
Domain performance
Coding
#14 / 160
88.3
Research
#9 / 174
96.1
Agents
#18 / 125
84.3
Vision
#12 / 65
90.6
Long context
#38 / 82
76.3
Evaluation highlights
All evaluations
Arena Text Rating
Reasoning · Arena.ai Text
1,493.09Elo
4
/ 354
MCP-Atlas
Agents · Meta Muse Spark 1.1 Evaluation Report
88.1%
1
/ 40
Arena WebDev Rating
Coding · Arena.ai WebDev
1,538.11Elo
12
/ 88
BabyVision (w/ tools)
Multimodal · Meta Muse Spark 1.1 Evaluation Report
76.3%
3
/ 5
MRCR 1M
Long context · Meta Muse Spark 1.1 Evaluation Report
54.1%
5
/ 5
Arena Agent Tool Hallucination
Agents · Arena.ai Agent
1.33%
1
/ 31
Basic information
Context (input / output)
1M / -
Release date
2026-07
Input modalities
Text · Image · Video · Audio · pdf
Output modalities
Text
Release date
2026-07-09
Related links
Official site