大语言模型

Qwen3.7-Max

阿里巴巴的专有“Agent Frontier”旗舰——顶尖的知识得分与跨 1M token 上下文的长跨度自主能力。

Qwen3.7-Max 标志着阿里巴巴产品线顶层一次有意的由开转闭:这款“Agent Frontier”模型是专有且仅 API、仅文本的,配 1M token 上下文,并在其同侪中拿下最高的知识得分(例如 GPQA Diamond 92.4)。

它的招牌演示是耐力——一次约 35 小时的自主运行,串起超过 1,000 次工具调用,并原生支持 Anthropic API 协议,因此能直接接入像 Claude Code 这样的运行框架。这让它更适合长跨度的智能体工作,而非快速对话。对需要自托管的团队,阿里此前的开源权重 Qwen 版本仍是备选。

它并非原始智能的领跑者(Opus 4.8、GPT-5.5 与 Gemini 3.1 Pro 在其之上),但对于阿里云上知识密集、长时运行的智能体,它是一个强劲而独特的选择。

注: 阿里巴巴于 2026 年 8 月 3 日发布了 Qwen3.8-Max——2.4T 参数的继任者,全面超越 Qwen3.7-Max(TerminalBench 74.5 → 86.6,PaperBench 64.8 → 93.0),定价 $2/$6。Qwen3.7-Max 仍可使用,但不再是旗舰。

适用场景

  • 长跨度自主智能体
  • 知识密集型研究任务
  • 阿里云上的企业工作流

优缺点

优势

  • 同侪中最高的知识得分
  • 演示过 35 小时、1,000+ 次工具调用的自主运行
  • 1M token 上下文窗口

局限

  • 专有且仅 API(顶层从开源权重的转向)
  • 仅文本;整体智能指数落后前三名

来源

最后更新:2026-08-05 · 规格与价格变动很快——使用前请在厂商官网核实。