Nvidia 发布 Nemotron 3.5 Lightning 混合架构模型

Nvidia Nemotron 3.5 Lightning

Nvidia 发布 Nemotron 3.5 Lightning 混合架构模型

Nvidia 推出了最新的 Nemotron-3.5-Lightning-30B-A3B-NVFP4 模型,这是一款专为高效推理和自主 Agent 设计的混合架构大语言模型。该模型采用 Mamba-2 与 MoE 及 Attention 层的混合结构,总参数量达 300 亿,但激活参数仅为 30 亿,支持高达 100 万 token 的上下文长度。它可在单张 DGX Spark (GB10) 或 H100 显卡上部署,并配合 DSpark 等推测解码技术显著提升生成速度。从代码生成到复杂推理任务,Nemotron 3.5 Lightning 旨在为开发者提供在本地硬件上运行高性能 AI 应用的解决方案,同时保持商业可用性。

NVIDIA Nemotron 是一个开放模型家族,提供开放权重、训练数据和配方,旨在为构建专用 AI Agent 提供领先的效率和准确性。

同日更多故事

2026-08-11