英伟达(NVDA)通过发布Nemotron 3.5 Lightning并推进万亿参数的Nemotron 4系列,正加速从AI芯片供应商向开源模型生态建设者延伸。这一战略的核心逻辑在于以模型普及带动算力需求,尽管面临与客户及被投企业的竞争、且当前模型性能仍落后于全球最前沿,但Nemotron 4的成败将决定英伟达能否构建覆盖硬件、软件和模型的完整AI技术栈,从而在长期维持其GPU市场的增长动力。
Nemotron 3.5 Lightning是一款拥有300亿参数的混合专家模型,主要用于帮助开发者构建更加智能且高效的AI智能体应用。英伟达将其称为同类产品中针对长时间运行AI智能体工作负载效率最高的模型。
与传统聊天机器人主要围绕单次问答不同,AI智能体通常需要执行多步骤推理、调用不同工具并持续完成复杂任务,因此模型运行效率、推理成本以及不同模型之间的调度能力变得更加重要。英伟达希望通过Nemotron 3.5 Lightning进一步切入这一快速增长的应用场景。
与此同时,公司还同步推出开源库NeMo Switchyard,为主流AI智能体工具提供智能模型路由功能。企业可以根据自身需求建立专属路由系统,部署完成后,NeMo Switchyard能够根据不同任务,将请求自动发送给能力和特性更加匹配的AI模型,同时无需开发人员重新编写现有应用程序。英伟达表示,Nemotron 3.5 Lightning与NeMo Switchyard结合后,可以让企业更加灵活地控制AI如何部署、在哪里运行以及以何种效率运行,覆盖PC、工作站、数据中心和云端等不同计算环境。
除了Nemotron 3.5 Lightning之外,英伟达还在推进规模和性能更加激进的下一代Nemotron 4系列。据The Information援引多名参与Nemotron项目的人士报道,英伟达希望该系列中规模最大的模型在性能上能够与全球最优秀的开源AI模型竞争。多名参与项目的员工预计,最大的Nemotron 4模型将至少拥有1万亿参数,约为英伟达今年6月推出的Nemotron 3 Ultra参数规模的两倍。目前Nemotron 4的最终规格和发布时间尚未确定,报道称最终训练尚未开始,而这一过程本身可能需要数月时间,有员工预计该模型最快可能在今年秋季晚些时候准备就绪。
今年3月,英伟达成立了Nemotron Coalition,与全球多家领先AI实验室合作开发开源前沿模型。公司当时表示,该联盟共同打造的首个模型将成为未来Nemotron 4开源模型系列的基础。英伟达生成式AI副总裁Kari Briski表示,公司投资Nemotron,是因为其认为每一家企业、每一个国家都需要能够获取的前沿开源模型,以增强安全性、加快创新,并提供可以跨越不同技术世代持续使用的基础。