STORY · 事件进行中

NVIDIA 发布 Nemotron 3.5 Lightning

2 个精选信源 · 3 篇报道持续 1最新动态 1小时前
最新进展

NVIDIA 发布 Nemotron 3.5 Lightning,30B MoE 模型,速度提升 4 倍,性能对标 gpt-oss-120b。

DIGEST

事件全貌

AI 综述 · 更新于 56分钟前

NVIDIA 于 2026 年 8 月 11 日发布 Nemotron 3.5 Lightning,一款开源混合专家(MoE)模型,总参数量约 300 亿(31.6B),激活参数 3.6B,采用 OpenMDW-1.1 商用许可。该模型专为本地智能体任务设计,可在 RTX PC、DGX Spark 及 Jetson 等设备上运行,支持 1M token 上下文窗口。

性能方面,Nemotron 3.5 Lightning 输出速度近 670 tokens/秒,相比同类开源模型最高提升 4 倍,智能体任务完成时间缩短 30%。在 Artificial Analysis 智能指数上得 24 分,较前代提升 9 分,性能对标 gpt-oss-120b,但参数量仅为其约四分之一。

同时,NVIDIA 发布开源模型路由库 NeMo Switchyard,可将任务成本降至 Opus 4.8 单独运行的近三分之一,进一步提升智能体 AI 效率。

本综述由 AI 汇总全部报道生成,随事件进展持续更新;下方时间线中的单篇报道保留其发布时的原貌。

24 HOURS

本事件热度走势

当前热度 39峰值 408月11日 21:31近24小时变化

移动指针或点击图表查看每小时热度;键盘可用左右方向键切换。

TIMELINE

报道时间线

3 条公开报道 · 官方一手 2 条 · 最新在前
  1. NVIDIA 发布首款 Nemotron 3.5 模型 Lightning,性能对标 gpt-oss-120b
    X:Artificial Analysis (@ArtificialAnlys)

    NVIDIA 发布首款 Nemotron 3.5 模型 Lightning,31.6B 总参数(3.6B 激活),性能对标 gpt-oss-120b,参数量仅为其约四分之一。该模型在 Artificial Analysis 智能指数得 24 分,较前代提升 9 分,输出速度近 670 tokens/秒,支持 1M token 上下文窗口,采用 OpenMDW-1.1 商用许可。

  2. NVIDIA 发布 Nemotron 3.5 Lightning 与 NeMo Switchyard,提升智能体 AI 效率
    NVIDIA Blog(RSS)官方一手

    NVIDIA 扩展 Nemotron 3 模型家族,推出 300 亿参数混合专家模型 Nemotron 3.5 Lightning,面向高吞吐智能体工作负载,输出速度最高提升 4 倍,智能体任务完成速度提升 30%。同时发布开源模型路由库 NeMo Switchyard,可将任务成本降至 Opus 4.8 单独运行的近三分之一,并支持在 RTX PC、DGX 等本地设备部署。

  3. NVIDIA 推出 Nemotron 3.5 Lightning,加速本地智能体任务
    NVIDIA Blog(RSS)官方一手精选

    NVIDIA 发布 Nemotron 3.5 Lightning,一款可定制的开源 30B 混合专家(MoE)模型,专为常驻智能体设计。相比同类开源模型,其 token 生成速度最高提升 4 倍,任务完成时间缩短 30%。该模型采用开放权重,支持用户微调以匹配特定任务,并可在 RTX PC、DGX Spark 及 Jetson 等设备上运行。