NVIDIA发布Nemotron 3.5 Lightning:一款轻量级的混合专家模型
英伟达发布了名为Nemotron 3.5 Lightning的人工智能轻量级开放模型,该模型专为高流量的代理任务设计。同时发布的还有NeMo Switchyard,这是一个开源路由库,能够将每个代理工作流程步骤导向最高效和有能力的模型。Lightning是一个拥有30B参数但只有3B活跃参数的混合专家模型,基于Mamba-2、混合专家(MoE)和注意力机制架构,并具有1M令牌的上下文窗口。英伟达报告称,与类似规模的模型相比,Lightning的速度快4倍,在PinchBench任务上比Qwen3.6 35B快30%,且准确度相当。该技术已应用于网络安全、法律服务、软件工程、金融服务和医疗保健等多个行业,并可在单个现代GPU上部署。
