北京时间2026年8月11日晚(太平洋时间8月11日上午),英伟达正式发布新一代开放权重模型 Nemotron 3.5 Lightning,并同步推出开源路由库 NeMo Switchyard,进一步落实构建开放 AI 生态的战略方向。
一、核心亮点一
1. 30B-A3B 混合 MoE 架构,专为高吞吐智能体优化。
2. Nemotron 3.5 Lightning 采用 300 亿总参数、30 亿激活参数的开放混合专家(MoE)架构。据英伟达官方数据,该模型输出速度可达同类开放模型的 4 倍,智能体任务完成速度提升约 30%(基于 PinchBench 评测)。其定位为大型多智能体系统中的“执行层”,适用于工具调用、结果校验与子智能体委派等高频任务。
二、核心亮点二
1. 全场景部署,保障数据合规。
2. 模型支持在本地工作站(如 RTX PRO、RTX PC)、边缘设备(如 Jetson)、数据中心及云端灵活部署。当选择本地部署时,敏感数据无需离开企业可控环境,满足金融、医疗等强监管行业的合规要求。轻量化设计有助于企业利用现有 IT 基础设施,控制算力成本。
三、核心亮点三
1. OpenMDW-1.1 许可,训练数据与配方公开。
2. 英伟达基于 OpenMDW-1.1 许可,英伟达公开了模型权重、训练数据集及训练配方(Recipes),支持模型追溯、审计及二次开发,显著降低企业定制化门槛。具体许可条款与数据公开范围以 Hugging Face 官方模型卡为准。
四、配套工具
1. NeMo Switchyard 智能路由库。
2. NeMo Switchyard 作为开源“调度员”,可自动将请求路由至最匹配的模型(如轻量模型处理简单问答,强模型处理复杂推理),无需重写应用代码。企业可自定义路由规则,灵活整合开源、专有及第三方模型。该路由库目前处于 pre-alpha 阶段,不建议直接用于生产环境。
五、此外,英伟达配套发布了强化学习数据集 Nemotron-RL Agentic Terminal Pivot,用于提升模型在终端环境下的智能体操作能力,进一步降低企业构建专属 AI 助手的门槛。
从算力供应到生态构建,英伟达正加速转型。对企业用户而言,这意味着获得更多可控、可定制的技术选项,减少对单一封闭平台的依赖。
信息整理: 寰识科技(上海)有限公司
发布日期: 2026年8日12日