STORY · 事件已收束

NVIDIA 发布 Nemotron 3.5 Lightning

8 个精选信源 · 9 篇报道持续 1最新动态 24天前
最新进展

最新报道补充了 PinchBench 准确率 86% 及比 Qwen3.6 35B 快 30% 等细节,并确认权重已上架 HuggingFace。

DIGEST

事件全貌

AI 综述 · 更新于 24天前

NVIDIA 于 2026 年 8 月 11 日发布 Nemotron 3.5 Lightning,一款开源混合专家(MoE)模型,总参数量约 300 亿(31.6B),激活参数 3.6B,采用 OpenMDW-1.1 商用许可。该模型专为本地智能体任务设计,可在 RTX PC、DGX Spark 及 Jetson 等设备上运行,支持 1M token 上下文窗口。

性能方面,Nemotron 3.5 Lightning 输出速度近 670 tokens/秒,相比同类开源模型最高提升 4 倍,智能体任务完成时间缩短 30%。在 Artificial Analysis 智能指数上得 24 分,较前代提升 9 分,性能对标 gpt-oss-120b,但参数量仅为其约四分之一。

同时,NVIDIA 发布开源模型路由库 NeMo Switchyard,可将任务成本降至 Opus 4.8 单独运行的近三分之一,进一步提升智能体 AI 效率。最新报道补充,该模型在 PinchBench 准确率达 86%,跑 1 万个任务比 Qwen3.6 35B 快 30%,且权重已上架 HuggingFace。

本综述由 AI 汇总全部报道生成,随事件进展持续更新;下方时间线中的单篇报道保留其发布时的原貌。

TIMELINE

报道时间线

9 条公开报道 · 官方一手 2 条 · 最新在前
  1. NVIDIA 发布 Nemotron 3.5 Lightning:30B 开源 MoE 模型与 NeMo Switchyard 模型路由器
    MarkTechPost(RSS)

    NVIDIA 推出 Nemotron 3.5 Lightning,一款 30B 参数、3B 活跃参数的混合 Mamba-2 + MoE + Attention 架构开源模型,上下文窗口达 1M token,采用 OpenMDW-1.1 许可,允许商用。

  2. 英伟达推出 30B 开源 AI 模型 Nemotron 3.5 Lightning
    IT之家(RSS)

    英伟达推出 300 亿参数的 MoE 开源模型 Nemotron 3.5 Lightning,专为大型多智能体系统中的特定任务打造。与同类模型相比,其输出速度提升最高达 4 倍,可将智能体任务整体完成速度加快 30%。该模型可直接运行于 NVIDIA RTX PC、DGX Spark 等本地设备,也可扩展至边缘 AI 与数据中心环境。

  3. BestBlogs 早报:NVIDIA 发布 Nemotron 3.5 Lightning,Gemini 月活破 10 亿
    X:洪明 (@hongming731)

    NVIDIA 发布 Nemotron 3.5 Lightning,30B MoE 每次仅激活 3B 参数,面向常驻智能体高频任务。LangChain 测试 Switchyard,30B 模型承担 93% 调用,比 Claude Opus 4.8 便宜 74%。Gemini 应用月活突破 10 亿,成为第 14 款达此里程碑的 Google 产品。

  4. NVIDIA 开源 Nemotron 3.5 Lightning,Agent 执行成本降至 1/3
    X:阿易 AI Notes (@AYi_AInotes)

    NVIDIA 发布开源模型 Nemotron 3.5 Lightning,300 亿总参数、每次仅激活 30 亿,专为 24 小时在线的 AI Agent 执行层设计,速度是同级别模型的 4 倍,PinchBench 准确率 86%,跑 1 万个任务比 Qwen3.6 35B 快 30%。

  5. NVIDIA 发布 Nemotron 3.5 Lightning 开源模型
    X:Testing Catalog (@testingcatalog)

    NVIDIA 发布 Nemotron 3.5 Lightning,一个开源 30B MoE 模型,仅 3B 参数激活,专为高频任务智能体设计。其输出速度最高达同类模型的 4 倍,比 Qwen3.6 35B 快 35%,性能相当。权重已上架 HuggingFace。

  6. Nvidia 发布 Nemotron 3.5 Lightning:以速度优先于极致智能
    The Decoder:AI News(RSS)

    Nvidia 发布 Nemotron 3.5 Lightning,这是 Nemotron 3.5 系列首款模型,总参数 316 亿、激活参数仅 36 亿。该模型在 Artificial Analysis 智能指数上得 24 分,与 OpenAI gpt-oss-120b 持平,但推理速度近每秒 670 tokens,为对比中最高。

  7. NVIDIA 发布首款 Nemotron 3.5 模型 Lightning,性能对标 gpt-oss-120b
    X:Artificial Analysis (@ArtificialAnlys)

    NVIDIA 发布首款 Nemotron 3.5 模型 Lightning,31.6B 总参数(3.6B 激活),性能对标 gpt-oss-120b,参数量仅为其约四分之一。该模型在 Artificial Analysis 智能指数得 24 分,较前代提升 9 分,输出速度近 670 tokens/秒,支持 1M token 上下文窗口,采用 OpenMDW-1.1 商用许可。

  8. NVIDIA 发布 Nemotron 3.5 Lightning 与 NeMo Switchyard,提升智能体 AI 效率
    NVIDIA Blog(RSS)官方一手

    NVIDIA 扩展 Nemotron 3 模型家族,推出 300 亿参数混合专家模型 Nemotron 3.5 Lightning,面向高吞吐智能体工作负载,输出速度最高提升 4 倍,智能体任务完成速度提升 30%。同时发布开源模型路由库 NeMo Switchyard,可将任务成本降至 Opus 4.8 单独运行的近三分之一,并支持在 RTX PC、DGX 等本地设备部署。

  9. NVIDIA 推出 Nemotron 3.5 Lightning,加速本地智能体任务
    NVIDIA Blog(RSS)官方一手精选

    NVIDIA 发布 Nemotron 3.5 Lightning,一款可定制的开源 30B 混合专家(MoE)模型,专为常驻智能体设计。相比同类开源模型,其 token 生成速度最高提升 4 倍,任务完成时间缩短 30%。该模型采用开放权重,支持用户微调以匹配特定任务,并可在 RTX PC、DGX Spark 及 Jetson 等设备上运行。