Muse Code gegen das gesamte Feld.
Preis und Leistung im Vergleich mit Claude Opus 5, OpenAI Codex, DeepSeek V4, GLM-5.2 und MiniMax M3 — auf Basis der offiziellen Preislisten und veröffentlichter Benchmarks, Stand 7. August 2026.
API-Preise pro 1 Mio. Token
Gecachter Input ist der eigentliche Kostentreiber beim agentischen Coden — der Repository-Kontext wird in jedem Turn erneut gesendet.
Coding-Agent-Leistung
Agenten-Benchmarks messen das Modell innerhalb seines Harness. Die Werte stammen aus Metas veröffentlichter Evaluation und den Angaben der Anbieter; leere Zellen bedeuten: kein veröffentlichter Wert.

Terminal-Bench 2.1, das komplette Feld
Metas veröffentlichtes Diagramm liefert den Kontext, den die Tabelle nicht zeigen kann: Muse Spark 1.2 in Muse Code (82.9%) liegt auf Platz zwei hinter Claude Opus 5 max in Claude Code (86.7%), vor GPT 5.6 Terra max in Codex (81.8%), Grok 4.5 high in Grok Build (81.6%) und Gemini 3.6 Flash high im Antigravity CLI (78.9%) — und ganze 6.7 Punkte über dem eigenen Vorgänger, Muse Spark 1.1 im mini-swe-agent (76.2%).
Beim Preis: zwei verschiedene Duelle
Der Muse-Standardtarif ($1.25/$4.25) unterbietet Claude Opus 5 ($5/$25) um das 4- bis 6-Fache, liegt aber über dem chinesischen Open-Weight-Trio. Der Contributor-Tarif ($0.10/$0.20) rutscht beim Input sogar unter DeepSeek V4 Flash ($0.14) — der Preis dafür, dass du deine Daten teilst.
Bei der Leistung: Platz zwei — mit knappem Abstand
Auf Terminal-Bench 2.1 liegt Muse Spark 1.2 + Muse Code (82.9%) hinter Claude Opus 5 (86.7%) und knapp vor Codex mit GPT-5.6 Terra (81.8%); Grok Build (81.6%) und Antigravity CLI (78.9%) folgen dahinter. Auf DeepSWE 1.1 ist der Abstand größer (59.3% vs. 65.0%). Fast Frontier-Niveau, zu einem Bruchteil des Frontier-Preises.
Die Cache-Spalte entscheidet über die echte Rechnung
Agenten-Sessions senden den Repository-Kontext in jedem Turn erneut. Die $0.002 für gecachten Input beim Muse-Contributor-Tarif sind der niedrigste Wert der Tabelle; die $0.0028 von DeepSeek V4 Flash sind der einzige ernsthafte Konkurrent. Bei langen Sessions zählt diese Zeile mehr als der plakative Input-Preis.
Quellen: Preisliste und Evaluationsbericht der Meta Model API (research.meta.ai); veröffentlichte Preislisten von OpenAI (GPT-5.6, nach der Preissenkung vom 30. Juli 2026), Anthropic, xAI (Grok 4.5, 8. Juli 2026), Google (Gemini 3.6 Flash, 21. Juli 2026), DeepSeek (V4 Flash Public Beta, 31. Juli 2026), Z.AI und MiniMax; Preis-Tracker von Drittanbietern, geprüft am 7. August 2026. Die Benchmark-Bedingungen unterscheiden sich je nach Anbieter — versteh die Werte als Richtwerte. Preise ändern sich; prüfe sie vor der Budgetplanung auf der Seite des jeweiligen Anbieters.