英伟达(NVIDIA)正加速推进自研开源AI模型战略,试图以此扩大GPU需求,但这一策略也使其与部分重要客户和投资对象形成竞争关系。据The Information 11日报道,英伟达正在开发其Nemotron 4系列中规模最大的模型,目标是使其性能与全球最优秀的开源AI模型比肩。受此消息影响,英伟达美股盘前涨近2%。
据多名参与Nemotron项目的员工透露,英伟达计划开发的最大规模Nemotron 4模型参数量至少达到1万亿,约为其今年6月发布的现有最大模型Nemotron 3 Ultra的两倍。该模型参数规模仍将远低于中国头部开源模型,但英伟达同时强调其压缩技术可使较小模型实现超越性的性能表现。
在算力投入方面,英伟达通过向购买其芯片的云运营商租回AI服务器获取计算资源。截至今年4月,英伟达多年期云服务承诺金额已增至280亿美元,覆盖至2031年初,远高于一年前的水平,约为一年前的三倍。其中,相当部分算力将专门用于Nemotron模型训练。据悉,英伟达已就Nemotron 4最大模型的预训练数据和架构做出部分决策,但尚未确定最终规格和发布日期,最终训练运行也尚未启动,该过程可能耗时数月。多名员工预计该模型最早将于今年秋季末发布,另有员工认为时间可能更晚。
英伟达当前的芯片需求高度依赖少数几家前沿AI实验室和云运营商,包括OpenAI、微软和SpaceX,而这些客户中部分正在自研AI芯片。英伟达推进Nemotron的核心逻辑,在于通过培育开源生态,吸引从初创企业到大型传统企业的更广泛用户群体,从而降低对少数大客户的依赖。英伟达生成式AI副总裁Kari Briski在一封邮件中表示,英伟达投资Nemotron,是因为相信每家公司、每个国家都需要可获取的前沿开源模型,以强化安全保障、加速创新,并提供可跨代际依赖的基础。英伟达应用深度学习研究副总裁Bryan Catanzaro今年1月在一档播客中也表示,投资Nemotron“对我们公司的未来至关重要”。
在商业落地方面,Nemotron模型已获得部分企业采用,其中包括Palantir——该公司今年6月宣布与英伟达合作,将Nemotron模型用于美国政府客户。不过,目前Nemotron 3 Ultra在Arena及Artificial Analysis等机构的多项性能基准测试中,在美国开源模型中仅排名第二,在全球所有模型中排名落在前40名之外。
英伟达的开源押注使其陷入微妙处境:一方面与自身已投资的开源初创企业形成竞争,另一方面也对其最大客户构成潜在威胁。英伟达已向OpenAI投资300亿美元,后者是其芯片需求的最重要驱动力之一。与此同时,英伟达还对多家美国开源公司进行了大额投资,包括Reflection AI和Thinking Machines Lab,这些公司本身也在争取企业客户使用自有模型。
尽管如此,英伟达仍通过构建“Nemotron联盟”寻求协同效应。该联盟成员包括Reflection、Cursor、Thinking Machines和Mistral,这些公司在开发自有开源项目的同时,也为Nemotron 4贡献训练数据、评估支持和模型设计建议。初创公司Prime Intellect为模型训练贡献了30万个模拟环境;AI编程工具初创公司Cognition已就向英伟达提供编码训练数据进行了讨论,但其参与情况尚未正式公布。Prime Intellect首席执行官Vincent Weisser将这一联盟定位为抵抗“单一‘神’模型”垄断格局的集体行动,而非争夺最佳开源模型头衔的竞赛。
英伟达的开源转型也折射出AI竞争的地缘政治维度。据两名员工透露,英伟达去年初意识到美国开源模型已大幅落后,出于对自身商业价值的判断,决定推动弥合这一差距。在资金规模上,英伟达2028财年的云服务承诺金额约为70亿美元,与OpenAI和Anthropic的支出规模相比仍有差距,但已超过大多数头部开源实验室的历史累计融资总额。一名员工透露,英伟达正在努力争取为Nemotron项目获取更多算力。
津公网安备12011002023007号