Muse Spark 1.2 是 Meta Superintelligence Labs 2026 年 8 月 5 日的更新——一个编码导向的模型,与 Muse Code(Meta 首个终端编码智能体)同步发布。四个月内第三次 Muse 发布,这次的定位非常清晰:拼价格,不拼峰值性能。
在 Meta 自己公布的对比中,Spark 1.2 在每项编码基准上都落后于 Claude Opus 5。但以 $1.25/$4.25 每百万 token(贡献者层更是低至 $0.10/$0.20),它在每任务成本上低于大多数前沿模型——这才是本次发布真正的意义。
架构
| 规格 | 数值 |
|---|---|
| 模型系列 | Muse(Meta Superintelligence Labs) |
| 前代 | Muse Spark 1.1(2026 年 7 月 9 日) |
| 上下文窗口 | 1M tokens |
| 输入模态 | 文本、图像 |
| 输出模态 | 文本 |
| API 模型 ID | muse-spark-1.2(标准)/ muse-spark-1.2-contributor |
定价
| 层级 | 输入 / 1M | 缓存 / 1M | 输出 / 1M | RPM 上限 |
|---|---|---|---|---|
| 标准 | $1.25 | $0.15 | $4.25 | 3,000 |
| 贡献者 | $0.10 | $0.002 | $0.20 | 60 |
贡献者层以极低价格换取 Meta 使用你的提示词和补全来训练未来模型的许可。
基准
| 基准 | Muse Spark 1.2 | Claude Opus 5 | Codex (GPT-5.6 Terra) |
|---|---|---|---|
| Terminal-Bench 2.1 | 82.9% | 86.7% | 81.8% |
| DeepSWE 1.1 | 59.3% | 65.0% | 64.8% |
| Meta 内部编码基准 | 70.6% | 79.4% | 未公布 |
Artificial Analysis 给 Spark 1.2 评了 54 分(Intelligence Index,xhigh 档),与 GPT-5.5(55)和 Grok 4.5(54)基本持平,每任务约 $0.40。
Muse Code
真正的产品故事。Muse Code 是与 Spark 1.2 联合训练的终端编码智能体(macOS/Linux),能处理多步编码、并行运行子智能体、崩溃后恢复。
横向对比
- vs Claude Opus 5: Opus 5 在编码基准上领先 4–9 分。但 Spark 1.2 每任务成本更低——对很多工作流而言,价格差距比分数差距更重要。
- vs GPT-5.6 Sol: Sol 评分更高(AA 59 vs 54),定价 $5/$30——输入贵 4 倍,输出贵 7 倍。
- vs Grok 4.5: AA 指数持平(各 54)。Grok 4.5 定价 $2/$6 稍贵;Spark 贡献者层便宜 20 倍。
开放权重
8 月 10 日 Meta 宣布计划「数周内」发布 Spark 1.2 开放权重,但具体日期、许可和格式均未确认。
全景参见 2026 LLM 指南。
适用场景
- 通过 Muse Code 进行终端编码智能体任务
- 智能体工作流的高性价比前沿推理
- 开发者工具链集成(规划、多智能体编排)
- 开放权重发布后的微调基座
优缺点
优势
- 与 Muse Code 联合训练——模型与智能体框架协同优化,非后期拼接
- TB 2.1 82.9% 超 Codex/GPT-5.6 Terra(81.8%),每任务成本约为对手的一半
- AA 智能指数 54——与 GPT-5.5、Grok 4.5 持平,每任务开销更低
- 贡献者层($0.10/$0.20)是目前最便宜的前沿级推理——前提是接受训练数据共享条款
局限
- TB 2.1 82.9% 落后 Claude Opus 5(86.7%)——并非编码天花板
- DeepSWE 59.3% 落后 Opus 5(65.0%)和 Codex(64.8%)——仓库级深度任务差距更大
- Meta 内部基准显示与 Opus 5 相差 9 分(70.6% vs 79.4%)
- 贡献者层会将你的提示词和补全内容共享给 Meta 用于训练——需仔细阅读条款
常见问题
Muse Spark 1.2 什么时候发布的?
2026 年 8 月 5 日,与 Meta 首个终端编码智能体 Muse Code 同步发布。这是四个月内 Muse 系列的第三次发布(4 月 Muse Spark 1.0,7 月 1.1)。
与 Claude Opus 5 相比如何?
Opus 5 在 Meta 发布的每项编码基准上都领先:TB 2.1 86.7% vs 82.9%,DeepSWE 65.0% vs 59.3%,Meta 内部编码基准 79.4% vs 70.6%。但 Spark 1.2 每个 AA 任务约 $0.40——这是价格故事,不是能力故事。
什么是 Muse Code?
与 Spark 1.2 联合训练的终端编码智能体(macOS/Linux)。能处理多步编码任务、并行运行子智能体、维护检查点日志(崩溃后可恢复而非重新开始)。需 Meta Model API 凭证使用。
什么是贡献者层?
muse-spark-1.2-contributor:$0.10 输入 / $0.20 输出(分别便宜 12.5× 和 21.25×)。交换条件是 Meta 可使用你的提示词和补全来训练未来模型。RPM 上限 60(标准层 3,000)。