Perbandingan

Muse Code melawan semua pemain.

Harga dan kemampuan diadu dengan Claude Opus 5, OpenAI Codex, DeepSeek V4, GLM-5.2, dan MiniMax M3 — berdasarkan daftar harga resmi tiap vendor dan benchmark yang dipublikasikan, per 7 Agustus 2026.

Harga API, per 1 juta token

Input ter-cache adalah pos biaya terbesar dalam coding agentik — konteks repositori dikirim ulang di setiap giliran.

MODEL
INPUT
INPUT CACHE
OUTPUT
KEBIJAKAN DATA
muse-spark-1.2-contributorMETA
$0.10
$0.002
$0.20
Dapat dipakai untuk menyempurnakan produk Meta
muse-spark-1.2 (standard)META
$1.25
$0.15
$4.25
Tidak pernah dipakai untuk pelatihan; retensi nol lewat tim penjualan
Claude Opus 5 (Anthropic)
$5.00
$0.50
$25.00
Secara default tidak melatih dengan data API
GPT-5.6 Sol (OpenAI)
$5.00
$0.50
$30.00
Secara default tidak melatih dengan data API
GPT-5.6 Terra (OpenAI · Codex default)
$2.00
$0.20
$12.00
Secara default tidak melatih dengan data API
Grok 4.5 (xAI)
$2.00
$0.50
$6.00
Secara default tidak melatih dengan data API
Gemini 3.6 Flash (Google)
$1.50
$0.15
$7.50
Paket berbayar tidak dipakai untuk pelatihan
DeepSeek V4 Flash
$0.14
$0.0028
$0.28
Bobot terbuka; berlaku ketentuan API yang di-hosting
DeepSeek V4 Pro
$0.435
$0.0036
$0.87
Bobot terbuka; berlaku ketentuan API yang di-hosting
GLM-5.2 (Z.AI)
$1.40
$4.40
Bobot terbuka; berlaku ketentuan API yang di-hosting
MiniMax M3
$0.60
$2.40
Bobot terbuka; berlaku ketentuan API yang di-hosting

Kemampuan sebagai agen coding

Benchmark agen mengukur model di dalam harness-nya. Skor diambil dari evaluasi yang dipublikasikan Meta dan hasil yang dilaporkan tiap vendor; sel kosong berarti belum ada skor yang dipublikasikan.

Grafik batang Terminal-Bench 2.1: Claude Opus 5 86.7%, Muse Spark 1.2 82.9%, GPT 5.6 Terra 81.8%, Grok 4.5 81.6%, Gemini 3.6 Flash 78.9%, Muse Spark 1.1 76.2%

Terminal-Bench 2.1, peta persaingan lengkap

Grafik yang dipublikasikan Meta menambah konteks yang tidak bisa diberikan tabel: Muse Spark 1.2 di Muse Code (82.9%) duduk di posisi kedua di belakang Claude Opus 5 max di Claude Code (86.7%), unggul atas GPT 5.6 Terra max di Codex (81.8%), Grok 4.5 high di Grok Build (81.6%), dan Gemini 3.6 Flash high di Antigravity CLI (78.9%) — sekaligus 6.7 poin penuh di atas pendahulunya sendiri, Muse Spark 1.1 di mini-swe-agent (76.2%).

AGEN / MODEL
TERMINAL-BENCH 2.1
DEEPSWE 1.1
KONTEKS
BOBOT TERBUKA
Muse Code + Muse Spark 1.2Meta · model dan harness dilatih bersama
82.9%
59.3%
1M
Tidak (API + agen)
Claude Code + Opus 5Anthropic · agen pihak pertama
86.7%
65.0%
1M
Tidak (API + agen)
Codex + GPT-5.6 Terra (max)OpenAI · agen pihak pertama
81.8%
64.8%
1M
Tidak (API + agen)
Grok Build + Grok 4.5 (high)xAI · agen pihak pertama
81.6%
500K
Tidak (API + agen)
Antigravity CLI + Gemini 3.6 Flash (high)Google · agen pihak pertama
78.9%
1M
Tidak (API + agen)
DeepSeek V4 Flash / Provia OpenCode / harness pihak ketiga
1M
Ya (MIT)
GLM-5.2Z.AI · via harness pihak ketiga
Ya
MiniMax M3via harness pihak ketiga · 80%+ di SWE-bench Verified
Ya

Soal harga, dua pertarungan berbeda

Paket standar Muse ($1.25/$4.25) 4–6 kali lebih murah dari Claude Opus 5 ($5/$25), meski masih di atas trio bobot terbuka asal Tiongkok. Tier Contributor ($0.10/$0.20) bahkan turun di bawah DeepSeek V4 Flash ($0.14) untuk input — itulah harga dari berbagi datamu.

Soal kemampuan, posisi kedua — dengan selisih tipis

Di Terminal-Bench 2.1, Muse Spark 1.2 + Muse Code (82.9%) tertinggal dari Claude Opus 5 (86.7%) dan menang tipis atas Codex yang menjalankan GPT-5.6 Terra (81.8%), dengan Grok Build (81.6%) dan Antigravity CLI (78.9%) di belakangnya. Di DeepSWE 1.1 jaraknya lebih lebar (59.3% vs. 65.0%). Nyaris sekelas frontier, dengan harga hanya sepersekian dari harga frontier.

Kolom cache yang menentukan tagihan sebenarnya

Sesi agen mengirim ulang konteks repositori di setiap giliran. Input ter-cache Muse Contributor seharga $0.002 adalah angka terendah di tabel; $0.0028 milik DeepSeek V4 Flash jadi satu-satunya pesaing yang mendekat. Untuk sesi panjang, baris ini jauh lebih menentukan daripada harga input yang dipajang di etalase.

Sumber: daftar harga Meta Model API dan laporan evaluasi (research.meta.ai); daftar harga yang dipublikasikan OpenAI (GPT-5.6, setelah penurunan harga 30 Juli 2026), Anthropic, xAI (Grok 4.5, 8 Juli 2026), Google (Gemini 3.6 Flash, 21 Juli 2026), DeepSeek (beta publik V4 Flash, 31 Juli 2026), Z.AI, dan MiniMax; situs pelacak harga pihak ketiga, dicek 7 Agustus 2026. Kondisi benchmark berbeda antarvendor — perlakukan skor sebagai gambaran arah saja. Harga bisa berubah; verifikasi di halaman tiap vendor sebelum menyusun anggaran.