NVIDIA 发布 Nemotron 3.5 Lightning
NVIDIA 发布 Nemotron 3.5 Lightning,30B MoE 模型,速度提升 4 倍,性能对标 gpt-oss-120b。
事件全貌
NVIDIA 于 2026 年 8 月 11 日发布 Nemotron 3.5 Lightning,一款开源混合专家(MoE)模型,总参数量约 300 亿(31.6B),激活参数 3.6B,采用 OpenMDW-1.1 商用许可。该模型专为本地智能体任务设计,可在 RTX PC、DGX Spark 及 Jetson 等设备上运行,支持 1M token 上下文窗口。
性能方面,Nemotron 3.5 Lightning 输出速度近 670 tokens/秒,相比同类开源模型最高提升 4 倍,智能体任务完成时间缩短 30%。在 Artificial Analysis 智能指数上得 24 分,较前代提升 9 分,性能对标 gpt-oss-120b,但参数量仅为其约四分之一。
同时,NVIDIA 发布开源模型路由库 NeMo Switchyard,可将任务成本降至 Opus 4.8 单独运行的近三分之一,进一步提升智能体 AI 效率。
本综述由 AI 汇总全部报道生成,随事件进展持续更新;下方时间线中的单篇报道保留其发布时的原貌。
本事件热度走势
移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。
报道时间线
- NVIDIA 发布首款 Nemotron 3.5 模型 Lightning,性能对标 gpt-oss-120b
NVIDIA 发布首款 Nemotron 3.5 模型 Lightning,31.6B 总参数(3.6B 激活),性能对标 gpt-oss-120b,参数量仅为其约四分之一。该模型在 Artificial Analysis 智能指数得 24 分,较前代提升 9 分,输出速度近 670 tokens/秒,支持 1M token 上下文窗口,采用 OpenMDW-1.1 商用许可。
- NVIDIA 发布 Nemotron 3.5 Lightning 与 NeMo Switchyard,提升智能体 AI 效率
NVIDIA 扩展 Nemotron 3 模型家族,推出 300 亿参数混合专家模型 Nemotron 3.5 Lightning,面向高吞吐智能体工作负载,输出速度最高提升 4 倍,智能体任务完成速度提升 30%。同时发布开源模型路由库 NeMo Switchyard,可将任务成本降至 Opus 4.8 单独运行的近三分之一,并支持在 RTX PC、DGX 等本地设备部署。
- NVIDIA 推出 Nemotron 3.5 Lightning,加速本地智能体任务
NVIDIA 发布 Nemotron 3.5 Lightning,一款可定制的开源 30B 混合专家(MoE)模型,专为常驻智能体设计。相比同类开源模型,其 token 生成速度最高提升 4 倍,任务完成时间缩短 30%。该模型采用开放权重,支持用户微调以匹配特定任务,并可在 RTX PC、DGX Spark 及 Jetson 等设备上运行。