大语言模型

DeepSeek V4-Pro

开源权重的性价比冠军——以 MIT 许可、1M token 上下文,在闭源模型的零头价格下实现接近前沿的编码能力(SWE-V ~85%)。

DeepSeek V4-Pro 是 2026 年开源权重的性价比冠军。它是一个总参 1.6T / 激活 49B 的混合专家(MoE),在 SWE-bench Verified 上约 85%——与闭源前沿仅差几分——却采用宽松的 MIT 许可,价格也只是零头。

它的 DeepSeek Sparse Attention(DSA)正是让 1M token 上下文变得划算的关键:在满上下文下,单 token 的 FLOPs 只占上一代的一小部分。配套的 V4-Flash($0.14 / $0.28)是市面上最便宜的可信编码模型。

实话提醒:它在最难的基准上落后于绝对顶尖,且尽管是开源许可,部分企业法务团队对地缘政治与出口合规问题仍持谨慎态度。

适用场景

  • 预算有限下的高并发编码与智能体
  • 需要 1M 上下文的自托管部署
  • 成本敏感的 RAG 流水线

优缺点

优势

  • 开源权重(MIT),SWE-bench Verified 接近前沿(~85%)
  • 借 DeepSeek Sparse Attention 把 1M 上下文做到便宜
  • 价格比闭源前沿低 5–10×

局限

  • 在最难任务上落后顶尖几分
  • 部分企业团队顾虑地缘政治 / 出口合规的不确定性

来源

最后更新:2026-06-18 · 规格与价格变动很快——使用前请在厂商官网核实。