Comparativa

Muse Code frente a toda la competencia.

Precio y capacidad frente a Claude Opus 5, OpenAI Codex, DeepSeek V4, GLM-5.2 y MiniMax M3, según las tarifas oficiales de cada proveedor y los benchmarks publicados, a 7 de agosto de 2026.

Precios de API, por millón de tokens

La entrada cacheada es lo que de verdad paga la programación agéntica: el contexto del repositorio se reenvía en cada turno.

MODELO
ENTRADA
ENTRADA CACHEADA
SALIDA
POLÍTICA DE DATOS
muse-spark-1.2-contributorMETA
$0.10
$0.002
$0.20
Puede usarse para mejorar los productos de Meta
muse-spark-1.2 (standard)META
$1.25
$0.15
$4.25
Nunca se usa para entrenar; retención cero a través de ventas
Claude Opus 5 (Anthropic)
$5.00
$0.50
$25.00
Por defecto no entrena con datos de la API
GPT-5.6 Sol (OpenAI)
$5.00
$0.50
$30.00
Por defecto no entrena con datos de la API
GPT-5.6 Terra (OpenAI · Codex default)
$2.00
$0.20
$12.00
Por defecto no entrena con datos de la API
Grok 4.5 (xAI)
$2.00
$0.50
$6.00
Por defecto no entrena con datos de la API
Gemini 3.6 Flash (Google)
$1.50
$0.15
$7.50
El plan de pago no se usa para entrenar
DeepSeek V4 Flash
$0.14
$0.0028
$0.28
Pesos abiertos; aplican los términos de la API alojada
DeepSeek V4 Pro
$0.435
$0.0036
$0.87
Pesos abiertos; aplican los términos de la API alojada
GLM-5.2 (Z.AI)
$1.40
$4.40
Pesos abiertos; aplican los términos de la API alojada
MiniMax M3
$0.60
$2.40
Pesos abiertos; aplican los términos de la API alojada

Capacidad como agente de código

Los benchmarks de agentes miden el modelo dentro de su arnés. Puntuaciones tomadas de la evaluación publicada por Meta y de los resultados que reporta cada proveedor; las celdas vacías indican que no hay puntuación publicada.

Gráfico de barras de Terminal-Bench 2.1: Claude Opus 5 86.7%, Muse Spark 1.2 82.9%, GPT 5.6 Terra 81.8%, Grok 4.5 81.6%, Gemini 3.6 Flash 78.9%, Muse Spark 1.1 76.2%

Terminal-Bench 2.1, el panorama completo

El gráfico publicado por Meta añade un contexto que la tabla no puede dar: Muse Spark 1.2 dentro de Muse Code (82.9%) ocupa el segundo puesto por detrás de Claude Opus 5 max en Claude Code (86.7%), por delante de GPT 5.6 Terra max en Codex (81.8%), de Grok 4.5 high en Grok Build (81.6%) y de Gemini 3.6 Flash high en Antigravity CLI (78.9%) — y 6.7 puntos por encima de su propio predecesor, Muse Spark 1.1 en mini-swe-agent (76.2%).

AGENTE / MODELO
TERMINAL-BENCH 2.1
DEEPSWE 1.1
CONTEXTO
PESOS ABIERTOS
Muse Code + Muse Spark 1.2Meta · modelo y arnés entrenados juntos
82.9%
59.3%
1M
No (API + agente)
Claude Code + Opus 5Anthropic · agente propio
86.7%
65.0%
1M
No (API + agente)
Codex + GPT-5.6 Terra (max)OpenAI · agente propio
81.8%
64.8%
1M
No (API + agente)
Grok Build + Grok 4.5 (high)xAI · agente propio
81.6%
500K
No (API + agente)
Antigravity CLI + Gemini 3.6 Flash (high)Google · agente propio
78.9%
1M
No (API + agente)
DeepSeek V4 Flash / Provía OpenCode / arneses de terceros
1M
Sí (MIT)
GLM-5.2Z.AI · vía arneses de terceros
MiniMax M3vía arneses de terceros · más del 80% en SWE-bench Verified

En precio, dos batallas distintas

El plan estándar de Muse ($1.25/$4.25) cuesta entre 4 y 6 veces menos que Claude Opus 5 ($5/$25), aunque se sitúa por encima del trío chino de pesos abiertos. El nivel Contributor ($0.10/$0.20) baja en entrada incluso por debajo de DeepSeek V4 Flash ($0.14): el precio de compartir tus datos.

En capacidad, un segundo puesto muy ajustado

En Terminal-Bench 2.1, Muse Spark 1.2 + Muse Code (82.9%) queda por detrás de Claude Opus 5 (86.7%) y supera por poco a Codex con GPT-5.6 Terra (81.8%), con Grok Build (81.6%) y Antigravity CLI (78.9%) más atrás. En DeepSWE 1.1 la brecha es mayor (59.3% frente a 65.0%). Rozando la frontera, a una fracción del precio de frontera.

La columna de caché decide la factura real

Las sesiones de agente reenvían el contexto del repositorio en cada turno. Los $0.002 de entrada cacheada de Muse Contributor son la cifra más baja de la tabla; los $0.0028 de DeepSeek V4 Flash son el único rival cercano. En sesiones largas, esta fila pesa más que el precio de entrada de titular.

Fuentes: tarifas de la Meta Model API e informe de evaluación (research.meta.ai); listas de precios publicadas por OpenAI (GPT-5.6, tras la rebaja del 30 de julio de 2026), Anthropic, xAI (Grok 4.5, 8 de julio de 2026), Google (Gemini 3.6 Flash, 21 de julio de 2026), DeepSeek (beta pública de V4 Flash, 31 de julio de 2026), Z.AI y MiniMax; rastreadores de precios de terceros, comprobados el 7 de agosto de 2026. Las condiciones de los benchmarks varían entre proveedores: toma las puntuaciones como orientativas. Los precios cambian; verifícalos en la página de cada proveedor antes de presupuestar.