Сравнение

Muse Code против всех.

Цена и возможности в сравнении с Claude Opus 5, OpenAI Codex, DeepSeek V4, GLM-5.2 и MiniMax M3 — по официальным прайс-листам вендоров и опубликованным бенчмаркам, по состоянию на 7 августа 2026 года.

Цены API, за 1 млн токенов

Основная статья расходов агентного кодинга — кэшированный ввод: контекст репозитория пересылается заново на каждом шаге.

МОДЕЛЬ
ВВОД
КЭШИРОВАННЫЙ ВВОД
ВЫВОД
ПОЛИТИКА ДАННЫХ
muse-spark-1.2-contributorMETA
$0.10
$0.002
$0.20
Может использоваться для улучшения продуктов Meta
muse-spark-1.2 (standard)META
$1.25
$0.15
$4.25
Никогда не используется для обучения; нулевое хранение — через отдел продаж
Claude Opus 5 (Anthropic)
$5.00
$0.50
$25.00
По умолчанию не обучается на данных API
GPT-5.6 Sol (OpenAI)
$5.00
$0.50
$30.00
По умолчанию не обучается на данных API
GPT-5.6 Terra (OpenAI · Codex default)
$2.00
$0.20
$12.00
По умолчанию не обучается на данных API
Grok 4.5 (xAI)
$2.00
$0.50
$6.00
По умолчанию не обучается на данных API
Gemini 3.6 Flash (Google)
$1.50
$0.15
$7.50
Платный тариф не используется для обучения
DeepSeek V4 Flash
$0.14
$0.0028
$0.28
Открытые веса; для хостинг-API действуют условия провайдера
DeepSeek V4 Pro
$0.435
$0.0036
$0.87
Открытые веса; для хостинг-API действуют условия провайдера
GLM-5.2 (Z.AI)
$1.40
$4.40
Открытые веса; для хостинг-API действуют условия провайдера
MiniMax M3
$0.60
$2.40
Открытые веса; для хостинг-API действуют условия провайдера

Возможности кодинг-агента

Агентные бенчмарки измеряют модель внутри её оболочки. Баллы взяты из опубликованной оценки Meta и данных самих вендоров; пустая ячейка означает, что опубликованного результата нет.

Столбчатая диаграмма Terminal-Bench 2.1: Claude Opus 5 86.7%, Muse Spark 1.2 82.9%, GPT 5.6 Terra 81.8%, Grok 4.5 81.6%, Gemini 3.6 Flash 78.9%, Muse Spark 1.1 76.2%

Terminal-Bench 2.1: полная картина

Опубликованная Meta диаграмма добавляет контекст, который таблица дать не может: Muse Spark 1.2 в Muse Code (82.9%) занимает второе место после Claude Opus 5 max в Claude Code (86.7%), опережая GPT 5.6 Terra max в Codex (81.8%), Grok 4.5 high в Grok Build (81.6%) и Gemini 3.6 Flash high в Antigravity CLI (78.9%) — и на целых 6.7 пункта обходит собственного предшественника, Muse Spark 1.1 в mini-swe-agent (76.2%).

АГЕНТ / МОДЕЛЬ
TERMINAL-BENCH 2.1
DEEPSWE 1.1
КОНТЕКСТ
ОТКРЫТЫЕ ВЕСА
Muse Code + Muse Spark 1.2Meta · модель и оболочка обучались вместе
82.9%
59.3%
1M
Нет (API + агент)
Claude Code + Opus 5Anthropic · собственный агент
86.7%
65.0%
1M
Нет (API + агент)
Codex + GPT-5.6 Terra (max)OpenAI · собственный агент
81.8%
64.8%
1M
Нет (API + агент)
Grok Build + Grok 4.5 (high)xAI · собственный агент
81.6%
500K
Нет (API + агент)
Antigravity CLI + Gemini 3.6 Flash (high)Google · собственный агент
78.9%
1M
Нет (API + агент)
DeepSeek V4 Flash / Proчерез OpenCode / сторонние оболочки
1M
Да (MIT)
GLM-5.2Z.AI · через сторонние оболочки
Да
MiniMax M3через сторонние оболочки · свыше 80% на SWE-bench Verified
Да

По цене — две разные битвы

Стандартный тариф Muse ($1.25/$4.25) в 4–6 раз дешевле Claude Opus 5 ($5/$25), но при этом дороже китайской тройки с открытыми весами. Тариф Contributor ($0.10/$0.20) по вводу опускается даже ниже DeepSeek V4 Flash ($0.14) — такова цена за то, что вы делитесь своими данными.

По возможностям — второе место, и совсем рядом

На Terminal-Bench 2.1 связка Muse Spark 1.2 + Muse Code (82.9%) уступает Claude Opus 5 (86.7%) и с минимальным отрывом обходит Codex на GPT-5.6 Terra (81.8%); Grok Build (81.6%) и Antigravity CLI (78.9%) позади. На DeepSWE 1.1 разрыв заметнее (59.3% против 65.0%). Почти фронтирный уровень — за долю фронтирной цены.

Реальный счёт определяет колонка кэша

Агентные сессии пересылают контекст репозитория на каждом шаге. $0.002 за кэшированный ввод у Muse Contributor — самая низкая цифра в таблице; единственный близкий соперник — DeepSeek V4 Flash с $0.0028. В длинных сессиях эта строка значит куда больше, чем заявленная цена ввода.

Источники: прайс-лист Meta Model API и отчёт об оценке (research.meta.ai); опубликованные прайс-листы OpenAI (GPT-5.6, после снижения цен 30 июля 2026 года), Anthropic, xAI (Grok 4.5, 8 июля 2026 года), Google (Gemini 3.6 Flash, 21 июля 2026 года), DeepSeek (публичная бета V4 Flash, 31 июля 2026 года), Z.AI и MiniMax; сторонние трекеры цен, сверено 7 августа 2026 года. Условия бенчмарков у вендоров различаются — воспринимайте баллы как ориентир. Цены меняются; перед планированием бюджета сверяйтесь со страницей каждого вендора.