Comparatif

Muse Code face à toute la concurrence.

Prix et capacités face à Claude Opus 5, OpenAI Codex, DeepSeek V4, GLM-5.2 et MiniMax M3 — d’après les grilles tarifaires officielles et les benchmarks publiés, au 7 août 2026.

Tarifs API, par million de tokens

L’entrée en cache, c’est ce que le codage agentique paie vraiment — le contexte du dépôt est renvoyé à chaque tour.

MODÈLE
ENTRÉE
ENTRÉE EN CACHE
SORTIE
POLITIQUE DE DONNÉES
muse-spark-1.2-contributorMETA
$0.10
$0.002
$0.20
Peut servir à améliorer les produits Meta
muse-spark-1.2 (standard)META
$1.25
$0.15
$4.25
Jamais utilisé pour l’entraînement ; rétention zéro via le service commercial
Claude Opus 5 (Anthropic)
$5.00
$0.50
$25.00
Pas d’entraînement sur les données API par défaut
GPT-5.6 Sol (OpenAI)
$5.00
$0.50
$30.00
Pas d’entraînement sur les données API par défaut
GPT-5.6 Terra (OpenAI · Codex default)
$2.00
$0.20
$12.00
Pas d’entraînement sur les données API par défaut
Grok 4.5 (xAI)
$2.00
$0.50
$6.00
Pas d’entraînement sur les données API par défaut
Gemini 3.6 Flash (Google)
$1.50
$0.15
$7.50
Offre payante non utilisée pour l’entraînement
DeepSeek V4 Flash
$0.14
$0.0028
$0.28
Poids ouverts ; conditions de l’API hébergée applicables
DeepSeek V4 Pro
$0.435
$0.0036
$0.87
Poids ouverts ; conditions de l’API hébergée applicables
GLM-5.2 (Z.AI)
$1.40
$4.40
Poids ouverts ; conditions de l’API hébergée applicables
MiniMax M3
$0.60
$2.40
Poids ouverts ; conditions de l’API hébergée applicables

Capacités d’agent de code

Les benchmarks d’agents mesurent le modèle au sein de son harnais. Scores tirés de l’évaluation publiée par Meta et des résultats annoncés par les éditeurs ; les cases vides signifient qu’aucun score n’a été publié.

Diagramme en barres Terminal-Bench 2.1 : Claude Opus 5 86.7%, Muse Spark 1.2 82.9%, GPT 5.6 Terra 81.8%, Grok 4.5 81.6%, Gemini 3.6 Flash 78.9%, Muse Spark 1.1 76.2%

Terminal-Bench 2.1, le classement complet

Le graphique publié par Meta apporte un contexte que le tableau ne peut pas donner : Muse Spark 1.2 dans Muse Code (82.9%) prend la deuxième place derrière Claude Opus 5 max dans Claude Code (86.7%), devant GPT 5.6 Terra max dans Codex (81.8%), Grok 4.5 high dans Grok Build (81.6%) et Gemini 3.6 Flash high dans Antigravity CLI (78.9%) — et 6.7 points pleins au-dessus de son propre prédécesseur, Muse Spark 1.1 dans mini-swe-agent (76.2%).

AGENT / MODÈLE
TERMINAL-BENCH 2.1
DEEPSWE 1.1
CONTEXTE
POIDS OUVERTS
Muse Code + Muse Spark 1.2Meta · modèle et harnais entraînés ensemble
82.9%
59.3%
1M
Non (API + agent)
Claude Code + Opus 5Anthropic · agent maison
86.7%
65.0%
1M
Non (API + agent)
Codex + GPT-5.6 Terra (max)OpenAI · agent maison
81.8%
64.8%
1M
Non (API + agent)
Grok Build + Grok 4.5 (high)xAI · agent maison
81.6%
500K
Non (API + agent)
Antigravity CLI + Gemini 3.6 Flash (high)Google · agent maison
78.9%
1M
Non (API + agent)
DeepSeek V4 Flash / Provia OpenCode / harnais tiers
1M
Oui (MIT)
GLM-5.2Z.AI · via harnais tiers
Oui
MiniMax M3via harnais tiers · plus de 80% sur SWE-bench Verified
Oui

Sur le prix, deux combats différents

L’offre standard de Muse ($1.25/$4.25) coûte 4 à 6 fois moins cher que Claude Opus 5 ($5/$25), tout en restant au-dessus du trio chinois à poids ouverts. L’offre Contributor ($0.10/$0.20) descend en entrée sous DeepSeek V4 Flash ($0.14) lui-même — le prix à payer pour partager tes données.

Sur les capacités, une deuxième place — de peu

Sur Terminal-Bench 2.1, Muse Spark 1.2 + Muse Code (82.9%) reste derrière Claude Opus 5 (86.7%) et devance de peu Codex avec GPT-5.6 Terra (81.8%), Grok Build (81.6%) et Antigravity CLI (78.9%) suivant derrière. Sur DeepSWE 1.1, l’écart se creuse (59.3% contre 65.0%). Un niveau proche de la frontière, pour une fraction du prix de la frontière.

La colonne cache décide de la vraie facture

Les sessions d’agent renvoient le contexte du dépôt à chaque tour. Les $0.002 d’entrée en cache de Muse Contributor sont le chiffre le plus bas du tableau ; les $0.0028 de DeepSeek V4 Flash sont le seul rival sérieux. Sur les longues sessions, cette ligne pèse plus que le prix d’entrée affiché.

Sources : tarifs de la Meta Model API et rapport d’évaluation (research.meta.ai) ; grilles tarifaires publiées par OpenAI (GPT-5.6, après la baisse du 30 juillet 2026), Anthropic, xAI (Grok 4.5, 8 juillet 2026), Google (Gemini 3.6 Flash, 21 juillet 2026), DeepSeek (bêta publique de V4 Flash, 31 juillet 2026), Z.AI et MiniMax ; trackers de prix tiers, vérifiés le 7 août 2026. Les conditions de benchmark varient d’un éditeur à l’autre — prends les scores comme des ordres de grandeur. Les prix bougent ; vérifie-les sur la page de chaque éditeur avant de budgéter.