Nemotron 3.5 Lightning 是 NVIDIA 于 2026 年 8 月 11 日为 Nemotron 3 系列新增的成员——定位为面向长时程智能体 AI 工作流的最高效率开放模型。与 NeMo Switchyard(一个用于智能多模型路由的开源库)同步发布。
Nemotron 3 Nano 面向小型/快速部署,Lightning 则为持续自主智能体任务优化——那种运行数分钟或数小时的任务,而非单轮问答。
关键规格
| 规格 | 数值 |
|---|---|
| 模型系列 | Nemotron 3 |
| 前代 | Nemotron 3 Nano |
| 定位 | 长时程智能体工作流最高效率 |
| 权重 | Hugging Face 开放 |
| 训练数据 | 在许可允许范围内发布——支持可追溯性和审计 |
NVIDIA 未在发布文章中披露详细参数量或完整架构规格。
NeMo Switchyard
配套发布的开源库,为主流智能体框架添加智能路由——根据具体需求将每个请求导向最合适、最具性价比的模型,无需重写应用。
可用性
| 渠道 | 状态 |
|---|---|
| Hugging Face | 可用 |
| build.nvidia.com(NIM) | 可用 |
| OpenRouter | 可用 |
| 云合作伙伴 | 可用 |
横向对比
- vs Muse Glimmer: 都是面向智能体的开放权重。Glimmer 是 30B 面向消费硬件;Lightning 面向 NVIDIA 企业 GPU 基础设施。
- vs Muse Spark 1.2: Spark 在前沿水平竞争(AA 54,TB 2.1 82.9%)。Lightning 的定位是效率优先而非峰值能力。
同步发布:Nemotron-RL-Agentic-Terminal-Pivot 数据集——用于后训练 Lightning 编码智能体能力的强化学习数据。
全景参见 2026 LLM 指南。
适用场景
- 需持续推理的长时程自主编码智能体
- NVIDIA 基础设施上的企业智能体 AI 工作流
- 通过 NeMo Switchyard 构建多模型路由架构
- 面向领域专用智能体任务的微调
优缺点
优势
- 同级别中面向长时程智能体工作流效率最高(NVIDIA 声称)
- 开放权重并附训练数据和技术文档——支持可追溯性和审计
- 配套 NeMo Switchyard——开源智能路由库,用于多模型智能体架构
- 广泛生态支持——HuggingFace、NIM、OpenRouter 和云合作伙伴 Day-1 可用
局限
- 发布文章未完整披露参数量和架构细节
- 初始公告未发布基准分数——「最高效率」是 NVIDIA 的营销定位
- NVIDIA 模型许可历史上有限制条款——需核查具体条款
- 面向企业和 GPU 基础设施——非消费/笔记本模型
常见问题
Nemotron 3.5 Lightning 什么时候发布的?
2026 年 8 月 11 日,与 NeMo Switchyard 同步发布。是 Nemotron 3 模型系列中继 Nemotron 3 Nano 之后的新成员。
什么是 NeMo Switchyard?
开源库,为主流智能体框架添加智能路由——将每个请求导向最合适的模型,开发者无需重写应用。
什么是 Nemotron Coalition?
一个贡献者组织,通过推理软件和数据集帮助推进模型发展。NVIDIA 在许可允许范围内发布训练数据和技术,以支持可追溯性。