对比

Muse Code 对阵全场。

与 Claude Opus 5、OpenAI Codex、DeepSeek V4、GLM-5.2、MiniMax M3 的价格与能力对比 —— 数据来自各厂商价目表与公开基准,截至 2026 年 8 月 7 日。

API 定价(每 100 万 token)

缓存输入才是 agentic 编码的主要开销 —— 仓库上下文每一轮都要重发。

模型
输入
缓存输入
输出
数据政策
muse-spark-1.2-contributorMETA
$0.10
$0.002
$0.20
可能用于改进 Meta 产品
muse-spark-1.2 (standard)META
$1.25
$0.15
$4.25
永不用于训练;零保留可联系销售
Claude Opus 5 (Anthropic)
$5.00
$0.50
$25.00
默认不用 API 数据训练
GPT-5.6 Sol (OpenAI)
$5.00
$0.50
$30.00
默认不用 API 数据训练
GPT-5.6 Terra (OpenAI · Codex default)
$2.00
$0.20
$12.00
默认不用 API 数据训练
Grok 4.5 (xAI)
$2.00
$0.50
$6.00
默认不用 API 数据训练
Gemini 3.6 Flash (Google)
$1.50
$0.15
$7.50
付费档不用于训练
DeepSeek V4 Flash
$0.14
$0.0028
$0.28
开放权重;托管 API 条款适用
DeepSeek V4 Pro
$0.435
$0.0036
$0.87
开放权重;托管 API 条款适用
GLM-5.2 (Z.AI)
$1.40
$4.40
开放权重;托管 API 条款适用
MiniMax M3
$0.60
$2.40
开放权重;托管 API 条款适用

编码代理能力

代理基准测的是模型在其执行框架内的表现。分数来自 Meta 公开评估与各厂商自报结果;空缺表示无公开分数。

Terminal-Bench 2.1 柱状图:Claude Opus 5 86.7%,Muse Spark 1.2 82.9%,GPT 5.6 Terra 81.8%,Grok 4.5 81.6%,Gemini 3.6 Flash 78.9%,Muse Spark 1.1 76.2%

Terminal-Bench 2.1 全场对比

Meta 公布的图表补充了表格给不了的上下文:Muse Code 中的 Muse Spark 1.2(82.9%)位居第二,落后于 Claude Code 中的 Claude Opus 5 max(86.7%),领先 Codex 中的 GPT 5.6 Terra max(81.8%)、Grok Build 中的 Grok 4.5 high(81.6%)和 Antigravity CLI 中的 Gemini 3.6 Flash high(78.9%)—— 并比自己的前代、mini-swe-agent 中的 Muse Spark 1.1(76.2%)整整高出 6.7 个百分点。

代理 / 模型
TERMINAL-BENCH 2.1
DEEPSWE 1.1
上下文
开放权重
Muse Code + Muse Spark 1.2Meta · 模型与框架联合训练
82.9%
59.3%
1M
否(API + 代理)
Claude Code + Opus 5Anthropic · 第一方代理
86.7%
65.0%
1M
否(API + 代理)
Codex + GPT-5.6 Terra (max)OpenAI · 第一方代理
81.8%
64.8%
1M
否(API + 代理)
Grok Build + Grok 4.5 (high)xAI · 第一方代理
81.6%
500K
否(API + 代理)
Antigravity CLI + Gemini 3.6 Flash (high)Google · 第一方代理
78.9%
1M
否(API + 代理)
DeepSeek V4 Flash / Pro经 OpenCode / 第三方框架
1M
是(MIT)
GLM-5.2Z.AI · 经第三方框架
MiniMax M3经第三方框架 · SWE-bench Verified 80%+

论价格,是两场不同的仗

Muse 标准档($1.25/$4.25)比 Claude Opus 5($5/$25)便宜 4–6 倍,同时高于中国开放权重三强。Contributor 档($0.10/$0.20)的输入价甚至低于 DeepSeek V4 Flash($0.14)—— 代价是共享你的数据。

论能力,紧咬第二名

Terminal-Bench 2.1 上,Muse Spark 1.2 + Muse Code(82.9%)落后 Claude Opus 5(86.7%),险胜跑 GPT-5.6 Terra 的 Codex(81.8%),Grok Build(81.6%)和 Antigravity CLI(78.9%)在后。DeepSWE 1.1 上差距更大(59.3% vs. 65.0%)。贴近前沿的能力,前沿价格的零头。

缓存那一列决定真实账单

代理会话每一轮都重发仓库上下文。Muse Contributor 的 $0.002 缓存输入是全表最低;DeepSeek V4 Flash 的 $0.0028 是唯一接近的对手。长会话里,这一行比标称输入价重要得多。

数据来源:Meta Model API 价目与评估报告(research.meta.ai);OpenAI(GPT-5.6,2026-07-30 降价后)、Anthropic、xAI(Grok 4.5,2026-07-08)、Google(Gemini 3.6 Flash,2026-07-21)、DeepSeek(V4 Flash 公测,2026-07-31)、Z.AI、MiniMax 公开价目表;第三方价格追踪站,核对于 2026 年 8 月 7 日。各厂商基准条件不同 —— 分数仅供方向性参考。价格会变动,预算前请到各厂商页面核实。