STORY · 事件已收束

NVIDIA 发布 NeMo Switchyard

4 个精选信源 · 4 篇报道持续 1最新动态 24天前
最新进展

LangChain 测试 Switchyard,30B 模型承担 93% 调用,比 Claude Opus 4.8 便宜 74%。

DIGEST

事件全貌

AI 综述 · 更新于 24天前

NVIDIA 扩展 Nemotron 3 模型家族,推出 300 亿参数混合专家模型 Nemotron 3.5 Lightning,面向高吞吐智能体工作负载,输出速度最高提升 4 倍,智能体任务完成速度提升 30%。同时发布开源模型路由库 NeMo Switchyard,可将任务成本降至 Opus 4.8 单独运行的近三分之一,并支持在 RTX PC、DGX 等本地设备部署。

发布时机选在 Meta 推出 Muse Glimmer 次日,展示本地智能体 AI 的不同路径。

该消息在 Hacker News 上获得 105 个点赞,引发社区关注。LangChain 测试 Switchyard 显示,30B 模型承担 93% 调用,比 Claude Opus 4.8 便宜 74%。Nemotron 3.5 Lightning 为 30B MoE,每次仅激活 3B 参数,面向常驻智能体高频任务。

本综述由 AI 汇总全部报道生成,随事件进展持续更新;下方时间线中的单篇报道保留其发布时的原貌。

TIMELINE

报道时间线

4 条公开报道 · 官方一手 1 条 · 最新在前
  1. BestBlogs 早报:NVIDIA 发布 Nemotron 3.5 Lightning,Gemini 月活破 10 亿
    X:洪明 (@hongming731)

    NVIDIA 发布 Nemotron 3.5 Lightning,30B MoE 每次仅激活 3B 参数,面向常驻智能体高频任务。LangChain 测试 Switchyard,30B 模型承担 93% 调用,比 Claude Opus 4.8 便宜 74%。Gemini 应用月活突破 10 亿,成为第 14 款达此里程碑的 Google 产品。

  2. Nvidia 发布 Nemotron 3.5 闪电系统与 NeMo Switchyard
    Hacker News 热门(buzzing.cc 中文翻译)

    Nvidia 推出 Nemotron 3.5 闪电系统及配套的 NeMo Switchyard 工具。该系统旨在提升大语言模型的推理效率与部署灵活性,相关细节已在 Nvidia 官方博客公布。该消息在 Hacker News 上获得 105 个点赞,引发社区关注。

  3. NVIDIA 发布 Nemotron 3.5 Lightning 与 NeMo Switchyard
    X:Kim (@kimmonismus)

    NVIDIA 在 Meta 发布 Muse Glimmer 次日推出 Nemotron 3.5 Lightning 和 NeMo Switchyard,展示本地智能体 AI 的不同路径。

  4. NVIDIA 发布 Nemotron 3.5 Lightning 与 NeMo Switchyard,提升智能体 AI 效率
    NVIDIA Blog(RSS)官方一手

    NVIDIA 扩展 Nemotron 3 模型家族,推出 300 亿参数混合专家模型 Nemotron 3.5 Lightning,面向高吞吐智能体工作负载,输出速度最高提升 4 倍,智能体任务完成速度提升 30%。同时发布开源模型路由库 NeMo Switchyard,可将任务成本降至 Opus 4.8 单独运行的近三分之一,并支持在 RTX PC、DGX 等本地设备部署。