Qwen3.7-Max 标志着阿里巴巴产品线顶层一次有意的由开转闭:这款“Agent Frontier”模型是专有且仅 API、仅文本的,配 1M token 上下文,并在其同侪中拿下最高的知识得分(例如 GPQA Diamond 92.4)。
它的招牌演示是耐力——一次约 35 小时的自主运行,串起超过 1,000 次工具调用,并原生支持 Anthropic API 协议,因此能直接接入像 Claude Code 这样的运行框架。这让它更适合长跨度的智能体工作,而非快速对话。对需要自托管的团队,阿里此前的开源权重 Qwen 版本仍是备选。
它并非原始智能的领跑者(Opus 4.8、GPT-5.5 与 Gemini 3.1 Pro 在其之上),但对于阿里云上知识密集、长时运行的智能体,它是一个强劲而独特的选择。
注: 阿里巴巴于 2026 年 8 月 3 日发布了 Qwen3.8-Max——2.4T 参数的继任者,全面超越 Qwen3.7-Max(TerminalBench 74.5 → 86.6,PaperBench 64.8 → 93.0),定价 $2/$6。Qwen3.7-Max 仍可使用,但不再是旗舰。
适用场景
- 长跨度自主智能体
- 知识密集型研究任务
- 阿里云上的企业工作流
优缺点
优势
- 同侪中最高的知识得分
- 演示过 35 小时、1,000+ 次工具调用的自主运行
- 1M token 上下文窗口
局限
- 专有且仅 API(顶层从开源权重的转向)
- 仅文本;整体智能指数落后前三名