NVIDIA 发布 NeMo Switchyard
LangChain 测试 Switchyard,30B 模型承担 93% 调用,比 Claude Opus 4.8 便宜 74%。
事件全貌
NVIDIA 扩展 Nemotron 3 模型家族,推出 300 亿参数混合专家模型 Nemotron 3.5 Lightning,面向高吞吐智能体工作负载,输出速度最高提升 4 倍,智能体任务完成速度提升 30%。同时发布开源模型路由库 NeMo Switchyard,可将任务成本降至 Opus 4.8 单独运行的近三分之一,并支持在 RTX PC、DGX 等本地设备部署。
发布时机选在 Meta 推出 Muse Glimmer 次日,展示本地智能体 AI 的不同路径。
该消息在 Hacker News 上获得 105 个点赞,引发社区关注。LangChain 测试 Switchyard 显示,30B 模型承担 93% 调用,比 Claude Opus 4.8 便宜 74%。Nemotron 3.5 Lightning 为 30B MoE,每次仅激活 3B 参数,面向常驻智能体高频任务。
本综述由 AI 汇总全部报道生成,随事件进展持续更新;下方时间线中的单篇报道保留其发布时的原貌。
报道时间线
- BestBlogs 早报:NVIDIA 发布 Nemotron 3.5 Lightning,Gemini 月活破 10 亿
NVIDIA 发布 Nemotron 3.5 Lightning,30B MoE 每次仅激活 3B 参数,面向常驻智能体高频任务。LangChain 测试 Switchyard,30B 模型承担 93% 调用,比 Claude Opus 4.8 便宜 74%。Gemini 应用月活突破 10 亿,成为第 14 款达此里程碑的 Google 产品。
- Nvidia 发布 Nemotron 3.5 闪电系统与 NeMo Switchyard
Nvidia 推出 Nemotron 3.5 闪电系统及配套的 NeMo Switchyard 工具。该系统旨在提升大语言模型的推理效率与部署灵活性,相关细节已在 Nvidia 官方博客公布。该消息在 Hacker News 上获得 105 个点赞,引发社区关注。
- NVIDIA 发布 Nemotron 3.5 Lightning 与 NeMo Switchyard
NVIDIA 在 Meta 发布 Muse Glimmer 次日推出 Nemotron 3.5 Lightning 和 NeMo Switchyard,展示本地智能体 AI 的不同路径。
- NVIDIA 发布 Nemotron 3.5 Lightning 与 NeMo Switchyard,提升智能体 AI 效率
NVIDIA 扩展 Nemotron 3 模型家族,推出 300 亿参数混合专家模型 Nemotron 3.5 Lightning,面向高吞吐智能体工作负载,输出速度最高提升 4 倍,智能体任务完成速度提升 30%。同时发布开源模型路由库 NeMo Switchyard,可将任务成本降至 Opus 4.8 单独运行的近三分之一,并支持在 RTX PC、DGX 等本地设备部署。