Vergleich

Muse Code gegen das gesamte Feld.

Preis und Leistung im Vergleich mit Claude Opus 5, OpenAI Codex, DeepSeek V4, GLM-5.2 und MiniMax M3 — auf Basis der offiziellen Preislisten und veröffentlichter Benchmarks, Stand 7. August 2026.

API-Preise pro 1 Mio. Token

Gecachter Input ist der eigentliche Kostentreiber beim agentischen Coden — der Repository-Kontext wird in jedem Turn erneut gesendet.

MODELL
INPUT
GECACHTER INPUT
OUTPUT
DATENRICHTLINIE
muse-spark-1.2-contributorMETA
$0.10
$0.002
$0.20
Kann zur Verbesserung von Meta-Produkten genutzt werden
muse-spark-1.2 (standard)META
$1.25
$0.15
$4.25
Nie fürs Training genutzt; Zero-Retention über den Vertrieb
Claude Opus 5 (Anthropic)
$5.00
$0.50
$25.00
Trainiert standardmäßig nicht mit API-Daten
GPT-5.6 Sol (OpenAI)
$5.00
$0.50
$30.00
Trainiert standardmäßig nicht mit API-Daten
GPT-5.6 Terra (OpenAI · Codex default)
$2.00
$0.20
$12.00
Trainiert standardmäßig nicht mit API-Daten
Grok 4.5 (xAI)
$2.00
$0.50
$6.00
Trainiert standardmäßig nicht mit API-Daten
Gemini 3.6 Flash (Google)
$1.50
$0.15
$7.50
Bezahl-Tarif wird nicht fürs Training genutzt
DeepSeek V4 Flash
$0.14
$0.0028
$0.28
Offene Gewichte; für die gehostete API gelten die Anbieterbedingungen
DeepSeek V4 Pro
$0.435
$0.0036
$0.87
Offene Gewichte; für die gehostete API gelten die Anbieterbedingungen
GLM-5.2 (Z.AI)
$1.40
$4.40
Offene Gewichte; für die gehostete API gelten die Anbieterbedingungen
MiniMax M3
$0.60
$2.40
Offene Gewichte; für die gehostete API gelten die Anbieterbedingungen

Coding-Agent-Leistung

Agenten-Benchmarks messen das Modell innerhalb seines Harness. Die Werte stammen aus Metas veröffentlichter Evaluation und den Angaben der Anbieter; leere Zellen bedeuten: kein veröffentlichter Wert.

Terminal-Bench 2.1 als Balkendiagramm: Claude Opus 5 86.7%, Muse Spark 1.2 82.9%, GPT 5.6 Terra 81.8%, Grok 4.5 81.6%, Gemini 3.6 Flash 78.9%, Muse Spark 1.1 76.2%

Terminal-Bench 2.1, das komplette Feld

Metas veröffentlichtes Diagramm liefert den Kontext, den die Tabelle nicht zeigen kann: Muse Spark 1.2 in Muse Code (82.9%) liegt auf Platz zwei hinter Claude Opus 5 max in Claude Code (86.7%), vor GPT 5.6 Terra max in Codex (81.8%), Grok 4.5 high in Grok Build (81.6%) und Gemini 3.6 Flash high im Antigravity CLI (78.9%) — und ganze 6.7 Punkte über dem eigenen Vorgänger, Muse Spark 1.1 im mini-swe-agent (76.2%).

AGENT / MODELL
TERMINAL-BENCH 2.1
DEEPSWE 1.1
KONTEXT
OFFENE GEWICHTE
Muse Code + Muse Spark 1.2Meta · Modell und Harness gemeinsam trainiert
82.9%
59.3%
1M
Nein (API + Agent)
Claude Code + Opus 5Anthropic · hauseigener Agent
86.7%
65.0%
1M
Nein (API + Agent)
Codex + GPT-5.6 Terra (max)OpenAI · hauseigener Agent
81.8%
64.8%
1M
Nein (API + Agent)
Grok Build + Grok 4.5 (high)xAI · hauseigener Agent
81.6%
500K
Nein (API + Agent)
Antigravity CLI + Gemini 3.6 Flash (high)Google · hauseigener Agent
78.9%
1M
Nein (API + Agent)
DeepSeek V4 Flash / Provia OpenCode / Drittanbieter-Harnesses
1M
Ja (MIT)
GLM-5.2Z.AI · via Drittanbieter-Harnesses
Ja
MiniMax M3via Drittanbieter-Harnesses · über 80% auf SWE-bench Verified
Ja

Beim Preis: zwei verschiedene Duelle

Der Muse-Standardtarif ($1.25/$4.25) unterbietet Claude Opus 5 ($5/$25) um das 4- bis 6-Fache, liegt aber über dem chinesischen Open-Weight-Trio. Der Contributor-Tarif ($0.10/$0.20) rutscht beim Input sogar unter DeepSeek V4 Flash ($0.14) — der Preis dafür, dass du deine Daten teilst.

Bei der Leistung: Platz zwei — mit knappem Abstand

Auf Terminal-Bench 2.1 liegt Muse Spark 1.2 + Muse Code (82.9%) hinter Claude Opus 5 (86.7%) und knapp vor Codex mit GPT-5.6 Terra (81.8%); Grok Build (81.6%) und Antigravity CLI (78.9%) folgen dahinter. Auf DeepSWE 1.1 ist der Abstand größer (59.3% vs. 65.0%). Fast Frontier-Niveau, zu einem Bruchteil des Frontier-Preises.

Die Cache-Spalte entscheidet über die echte Rechnung

Agenten-Sessions senden den Repository-Kontext in jedem Turn erneut. Die $0.002 für gecachten Input beim Muse-Contributor-Tarif sind der niedrigste Wert der Tabelle; die $0.0028 von DeepSeek V4 Flash sind der einzige ernsthafte Konkurrent. Bei langen Sessions zählt diese Zeile mehr als der plakative Input-Preis.

Quellen: Preisliste und Evaluationsbericht der Meta Model API (research.meta.ai); veröffentlichte Preislisten von OpenAI (GPT-5.6, nach der Preissenkung vom 30. Juli 2026), Anthropic, xAI (Grok 4.5, 8. Juli 2026), Google (Gemini 3.6 Flash, 21. Juli 2026), DeepSeek (V4 Flash Public Beta, 31. Juli 2026), Z.AI und MiniMax; Preis-Tracker von Drittanbietern, geprüft am 7. August 2026. Die Benchmark-Bedingungen unterscheiden sich je nach Anbieter — versteh die Werte als Richtwerte. Preise ändern sich; prüfe sie vor der Budgetplanung auf der Seite des jeweiligen Anbieters.