Category
Benchmark
Muse Spark 1.3 (max)
Meta
Muse Spark 1.2 (xhigh)
Meta
GPT 5.6 Sol (max)
OpenAI
Opus 5 (max)
Anthropic
Agent
Long Context
Coding
1754
64.9
90.3
57.8
49.6
98.5
98.1
75.4
59.4
88.8
1615
61.6
85.9
46.2
38.2
66.3
55.5
55.0
46.2
82.9
1710
45.4
93.1
60.5
46.7
91.5
73.8
73.0
53.5
88.8
1824
65.7
90.4
59.1
50.3
-
-
74.0
52.7
86.7