ITCOW牛新网 8月12日消息,英伟达于当地时间8月11日在其Nemotron 3系列中补入一枚30B量级的新成员Nemotron 3.5 Lightning,定位为面向大型多智能体系统的任务专用模型,权重同步在Hugging Face、ModelScope、OpenRouter与NVIDIA Build四地开源。

英伟达开源Nemotron 3.5 Lightning 30B MoE

这颗模型采用300亿总参、每次激活约3B的MoE结构,官方给出的性能锚点是输出速度较同档模型最高提至4倍,连带把智能体类任务的端到端完成耗时压缩约30%,适合在Agent编排里承担某一类固定子任务而非充当通用对话底座。部署侧刻意做成”从小端到数据中心”通吃:本地可跑在RTX PC、DGX Spark、DGX Station与Jetson,往上无缝扩到RTX PRO工作站、边缘盒子、企业机房直至云端集群,NVFP4精度版本也一并挂出,方便低带宽设备直接吃。

英伟达开源Nemotron 3.5 Lightning 30B MoE

据ITCOW牛新网了解,Nemotron 3.5 Lightning把”轻激活+高吞吐”作为卖点,意味着英伟达在把大模型能力往Agent运行时下沉时,优先保的是单步延迟与并发密度,而不是把参数堆到能替人写长篇。开发者既可以从Hugging Face拉nvidia/NVIDIA-Nemotron-3.5-Lightning-30B-A3B-NVFP4做本地微调,也能在OpenRouter走nemotron-3.5-lightning:free免鉴权试跑,降低多智能体原型验证的门槛。