大语言模型

Nemotron 3.5 Lightning

NVIDIA 面向长时程智能体工作流的最高效率开放模型——由 Nemotron Coalition 构建,配套 NeMo Switchyard 智能多模型路由。

Nemotron 3.5 Lightning 是 NVIDIA 于 2026 年 8 月 11 日为 Nemotron 3 系列新增的成员——定位为面向长时程智能体 AI 工作流的最高效率开放模型。与 NeMo Switchyard(一个用于智能多模型路由的开源库)同步发布。

Nemotron 3 Nano 面向小型/快速部署,Lightning 则为持续自主智能体任务优化——那种运行数分钟或数小时的任务,而非单轮问答。

关键规格

规格数值
模型系列Nemotron 3
前代Nemotron 3 Nano
定位长时程智能体工作流最高效率
权重Hugging Face 开放
训练数据在许可允许范围内发布——支持可追溯性和审计

NVIDIA 未在发布文章中披露详细参数量或完整架构规格。

NeMo Switchyard

配套发布的开源库,为主流智能体框架添加智能路由——根据具体需求将每个请求导向最合适、最具性价比的模型,无需重写应用。

可用性

渠道状态
Hugging Face可用
build.nvidia.com(NIM)可用
OpenRouter可用
云合作伙伴可用

横向对比

  • vs Muse Glimmer 都是面向智能体的开放权重。Glimmer 是 30B 面向消费硬件;Lightning 面向 NVIDIA 企业 GPU 基础设施。
  • vs Muse Spark 1.2 Spark 在前沿水平竞争(AA 54,TB 2.1 82.9%)。Lightning 的定位是效率优先而非峰值能力。

同步发布:Nemotron-RL-Agentic-Terminal-Pivot 数据集——用于后训练 Lightning 编码智能体能力的强化学习数据。

全景参见 2026 LLM 指南

适用场景

  • 需持续推理的长时程自主编码智能体
  • NVIDIA 基础设施上的企业智能体 AI 工作流
  • 通过 NeMo Switchyard 构建多模型路由架构
  • 面向领域专用智能体任务的微调

优缺点

优势

  • 同级别中面向长时程智能体工作流效率最高(NVIDIA 声称)
  • 开放权重并附训练数据和技术文档——支持可追溯性和审计
  • 配套 NeMo Switchyard——开源智能路由库,用于多模型智能体架构
  • 广泛生态支持——HuggingFace、NIM、OpenRouter 和云合作伙伴 Day-1 可用

局限

  • 发布文章未完整披露参数量和架构细节
  • 初始公告未发布基准分数——「最高效率」是 NVIDIA 的营销定位
  • NVIDIA 模型许可历史上有限制条款——需核查具体条款
  • 面向企业和 GPU 基础设施——非消费/笔记本模型

常见问题

Nemotron 3.5 Lightning 什么时候发布的?

2026 年 8 月 11 日,与 NeMo Switchyard 同步发布。是 Nemotron 3 模型系列中继 Nemotron 3 Nano 之后的新成员。

什么是 NeMo Switchyard?

开源库,为主流智能体框架添加智能路由——将每个请求导向最合适的模型,开发者无需重写应用。

什么是 Nemotron Coalition?

一个贡献者组织,通过推理软件和数据集帮助推进模型发展。NVIDIA 在许可允许范围内发布训练数据和技术,以支持可追溯性。

来源

最后更新:2026-08-11 · 规格与价格变动很快——使用前请在厂商官网核实。