Muse Code 对阵全场。
与 Claude Opus 5、OpenAI Codex、DeepSeek V4、GLM-5.2、MiniMax M3 的价格与能力对比 —— 数据来自各厂商价目表与公开基准,截至 2026 年 8 月 7 日。
API 定价(每 100 万 token)
缓存输入才是 agentic 编码的主要开销 —— 仓库上下文每一轮都要重发。
编码代理能力
代理基准测的是模型在其执行框架内的表现。分数来自 Meta 公开评估与各厂商自报结果;空缺表示无公开分数。

Terminal-Bench 2.1 全场对比
Meta 公布的图表补充了表格给不了的上下文:Muse Code 中的 Muse Spark 1.2(82.9%)位居第二,落后于 Claude Code 中的 Claude Opus 5 max(86.7%),领先 Codex 中的 GPT 5.6 Terra max(81.8%)、Grok Build 中的 Grok 4.5 high(81.6%)和 Antigravity CLI 中的 Gemini 3.6 Flash high(78.9%)—— 并比自己的前代、mini-swe-agent 中的 Muse Spark 1.1(76.2%)整整高出 6.7 个百分点。
论价格,是两场不同的仗
Muse 标准档($1.25/$4.25)比 Claude Opus 5($5/$25)便宜 4–6 倍,同时高于中国开放权重三强。Contributor 档($0.10/$0.20)的输入价甚至低于 DeepSeek V4 Flash($0.14)—— 代价是共享你的数据。
论能力,紧咬第二名
Terminal-Bench 2.1 上,Muse Spark 1.2 + Muse Code(82.9%)落后 Claude Opus 5(86.7%),险胜跑 GPT-5.6 Terra 的 Codex(81.8%),Grok Build(81.6%)和 Antigravity CLI(78.9%)在后。DeepSWE 1.1 上差距更大(59.3% vs. 65.0%)。贴近前沿的能力,前沿价格的零头。
缓存那一列决定真实账单
代理会话每一轮都重发仓库上下文。Muse Contributor 的 $0.002 缓存输入是全表最低;DeepSeek V4 Flash 的 $0.0028 是唯一接近的对手。长会话里,这一行比标称输入价重要得多。
数据来源:Meta Model API 价目与评估报告(research.meta.ai);OpenAI(GPT-5.6,2026-07-30 降价后)、Anthropic、xAI(Grok 4.5,2026-07-08)、Google(Gemini 3.6 Flash,2026-07-21)、DeepSeek(V4 Flash 公测,2026-07-31)、Z.AI、MiniMax 公开价目表;第三方价格追踪站,核对于 2026 年 8 月 7 日。各厂商基准条件不同 —— 分数仅供方向性参考。价格会变动,预算前请到各厂商页面核实。