大语言模型

Muse Spark 1.2

Meta 编码旗舰——与 Muse Code 终端智能体联合训练,TB 2.1 82.9%,$1.25/$4.25 标准定价,1M 上下文,已宣布将开放权重。

Muse Spark 1.2 是 Meta Superintelligence Labs 2026 年 8 月 5 日的更新——一个编码导向的模型,与 Muse Code(Meta 首个终端编码智能体)同步发布。四个月内第三次 Muse 发布,这次的定位非常清晰:拼价格,不拼峰值性能。

在 Meta 自己公布的对比中,Spark 1.2 在每项编码基准上都落后于 Claude Opus 5。但以 $1.25/$4.25 每百万 token(贡献者层更是低至 $0.10/$0.20),它在每任务成本上低于大多数前沿模型——这才是本次发布真正的意义。

架构

规格数值
模型系列Muse(Meta Superintelligence Labs)
前代Muse Spark 1.1(2026 年 7 月 9 日)
上下文窗口1M tokens
输入模态文本、图像
输出模态文本
API 模型 IDmuse-spark-1.2(标准)/ muse-spark-1.2-contributor

定价

层级输入 / 1M缓存 / 1M输出 / 1MRPM 上限
标准$1.25$0.15$4.253,000
贡献者$0.10$0.002$0.2060

贡献者层以极低价格换取 Meta 使用你的提示词和补全来训练未来模型的许可。

基准

基准Muse Spark 1.2Claude Opus 5Codex (GPT-5.6 Terra)
Terminal-Bench 2.182.9%86.7%81.8%
DeepSWE 1.159.3%65.0%64.8%
Meta 内部编码基准70.6%79.4%未公布

Artificial Analysis 给 Spark 1.2 评了 54 分(Intelligence Index,xhigh 档),与 GPT-5.5(55)和 Grok 4.5(54)基本持平,每任务约 $0.40

Muse Code

真正的产品故事。Muse Code 是与 Spark 1.2 联合训练的终端编码智能体(macOS/Linux),能处理多步编码、并行运行子智能体、崩溃后恢复。

横向对比

  • vs Claude Opus 5 Opus 5 在编码基准上领先 4–9 分。但 Spark 1.2 每任务成本更低——对很多工作流而言,价格差距比分数差距更重要。
  • vs GPT-5.6 Sol Sol 评分更高(AA 59 vs 54),定价 $5/$30——输入贵 4 倍,输出贵 7 倍。
  • vs Grok 4.5 AA 指数持平(各 54)。Grok 4.5 定价 $2/$6 稍贵;Spark 贡献者层便宜 20 倍。

开放权重

8 月 10 日 Meta 宣布计划「数周内」发布 Spark 1.2 开放权重,但具体日期、许可和格式均未确认。

全景参见 2026 LLM 指南

适用场景

  • 通过 Muse Code 进行终端编码智能体任务
  • 智能体工作流的高性价比前沿推理
  • 开发者工具链集成(规划、多智能体编排)
  • 开放权重发布后的微调基座

优缺点

优势

  • 与 Muse Code 联合训练——模型与智能体框架协同优化,非后期拼接
  • TB 2.1 82.9% 超 Codex/GPT-5.6 Terra(81.8%),每任务成本约为对手的一半
  • AA 智能指数 54——与 GPT-5.5、Grok 4.5 持平,每任务开销更低
  • 贡献者层($0.10/$0.20)是目前最便宜的前沿级推理——前提是接受训练数据共享条款

局限

  • TB 2.1 82.9% 落后 Claude Opus 5(86.7%)——并非编码天花板
  • DeepSWE 59.3% 落后 Opus 5(65.0%)和 Codex(64.8%)——仓库级深度任务差距更大
  • Meta 内部基准显示与 Opus 5 相差 9 分(70.6% vs 79.4%)
  • 贡献者层会将你的提示词和补全内容共享给 Meta 用于训练——需仔细阅读条款

常见问题

Muse Spark 1.2 什么时候发布的?

2026 年 8 月 5 日,与 Meta 首个终端编码智能体 Muse Code 同步发布。这是四个月内 Muse 系列的第三次发布(4 月 Muse Spark 1.0,7 月 1.1)。

与 Claude Opus 5 相比如何?

Opus 5 在 Meta 发布的每项编码基准上都领先:TB 2.1 86.7% vs 82.9%,DeepSWE 65.0% vs 59.3%,Meta 内部编码基准 79.4% vs 70.6%。但 Spark 1.2 每个 AA 任务约 $0.40——这是价格故事,不是能力故事。

什么是 Muse Code?

与 Spark 1.2 联合训练的终端编码智能体(macOS/Linux)。能处理多步编码任务、并行运行子智能体、维护检查点日志(崩溃后可恢复而非重新开始)。需 Meta Model API 凭证使用。

什么是贡献者层?

muse-spark-1.2-contributor:$0.10 输入 / $0.20 输出(分别便宜 12.5× 和 21.25×)。交换条件是 Meta 可使用你的提示词和补全来训练未来模型。RPM 上限 60(标准层 3,000)。

来源

最后更新:2026-08-11 · 规格与价格变动很快——使用前请在厂商官网核实。