几分钟内让 Muse Code 跑起来。
Muse Code 目前为 macOS 和 Linux 提供 Beta。它能承担大型仓库中的复杂软件工程任务 —— 规划变更、编写代码、验证结果 —— 全部在你的终端里完成。
1. 安装
一条命令装好 CLI:
脚本会把 muse 二进制放进 PATH —— 用 muse --version 验证。想先审查脚本?用 -o install.sh 下载、审计后再运行。
2. 认证
首次运行会打开浏览器,在 dev.meta.ai 用 Meta 开发者账号认证。凭据本地缓存 —— 之后的会话无需重新认证。访问与计费都走 Meta Model API。
MODEL_API_KEY。3. 运行第一个任务
认证完成后,进任何项目目录就能开工:
用自然语言描述你想要的结果。好的第一个任务是小且可验证的 —— “给 parseDate 补上缺失的测试并确保通过” —— 你会看到执行者起草改动、审查者提出批评、测试跑起来。
从第一天就值得了解的两个成本开关:Muse Spark 是推理模型 —— 回答前会思考,思考 token 按输出计费 —— /effort 可以按任务调高或调低思考量。你的语气、格式等常规要求可以放进 system message,不用每条提示词都重复。
异步后台代理
Muse Code 用一个简单的代理循环加一组异步后台代理来增强主代理的能力。这些专职代理在整个会话中保持活跃,而不是每个任务临时创建,避免了重复收集信息。它们自主执行后续步骤,并自行决定何时向主代理汇报 —— 这种常驻性降低了延迟,也减少了困难多步任务中的人工干预。
代理扇出与 git worktree
当一个工作拆成多个任务时,它们会自动扇出给独立的代理:父代理为每个任务生成一个可写子代理,每个子代理有自己的 git worktree —— 并行的子代理永远不会在同一批文件上冲突,你的工作副本始终干净。
事件日志
Muse Code 使用本地事件日志,每次模型调用、工具运行、审批和编辑都会追加进去。这个单一事实来源让运行时可以精确回放、安全重启:崩溃后代理会从停下的地方精确恢复,长时任务不会被故障打断。每次子代理的创建、引导和取消都可观测 —— muse replay 逐步回放会话,完整轨迹可导出用于交接或审计。
内置技能与命令
Muse Code 自带多个默认技能 —— 丢进去一个粗糙想法,拿出来一个反复拷问、验证过的功能:
Muse Spark 1.2
Muse Spark 1.2 是 Muse Spark 1.1 面向编码的更新版本,在代码生成、复杂调试、代码库理解和端到端开发工作流上均有提升 —— 编码任务的训练算力大幅扩容,同时扩展了环境多样性。三个突出特点:
基准成绩(配合 Muse Code):Terminal-Bench 2.1 · 82.9% — DeepSWE 1.1 · 59.3%。完整方法见 research.meta.ai 的评估报告。
案例研究:内核优化
Meta 测试了模型在 1,000+ 次工具调用(最长 24 小时)中迭代优化 GPU 内核的能力。在 Muse Code 的代理环境里,模型编写、编译、性能分析并持续改进内核性能,以 NVIDIA Hopper GPU 的 KDA 和 MLA 内核为基准。在禁止封装第三方内核库的前提下,它直接用 Triton 实现了算法 —— 并持续找到对基线的大幅改进。
Meta Model API
Muse Code 背后的模型也可直接使用 —— Muse Spark 1.2 同时上线 Muse Code、Meta Model API 和 OpenRouter,并扩大了全球开放范围。API 与 OpenAI SDK、Anthropic SDK 以及 OpenCode、Claude Code 等代理 CLI 即插即用:把客户端指向新的 base URL,其余代码不用动。上下文窗口为 1,048,576 token。
实战手册
复制即可运行的配方 —— 每个配方解决一个聚焦的问题、给出可运行的代码、指向下一步。三大板块,外加 Muse Code 核心模式的专属配方。浏览全部 28 个配方 →